Каждый из столбцов c_i является логическим столбцом, и я хотел бы вычислить агрегацию f(x, y) по строки, где c_i имеет значение True. (Например, f(x,y) = x.sum() * y.sum().)
Один из способов сделать это:
Код: Выделить всё
ds.select([
f(pl.col("x").filter(pl.col(f"c_{i+1}"), pl.col("y").filter(pl.col(f"c_{i+1}"))
for i in range(K)
])
- Какой рекомендуемый/самый эффективный/самый элегантный способ добиться этого?
Подробнее здесь: https://stackoverflow.com/questions/790 ... int-groups