Код: Выделить всё
df_X = pl.DataFrame({'last_name':['James','Warner','Marino','James','Warner','Marino','James'],
'first_name':['Horn','Bro','Kach','Horn','Bro','Kach','Horn'],
'dob':['03/06/1990','09/16/1990','03/06/1990','','03/06/1990','','']}
)

Я применяю группировку к столбцам «последний», «первый» и «dob», чтобы получить значения в виде
Код: Выделить всё
df_X.groupby(['last_name','first_name','dob']).agg(pl.count())

Здесь я хотел бы игнорировать значения NULL/EMPTY при группировке столбцов, поскольку
У Джеймса Хорна есть два пустых DOB, их не следует включать в операцию группировки.
Вот ожидаемый результат.

< /p>
Конечно, мы можем отфильтровать столбец, как показано ниже, прежде чем перейти к группировке как
Код: Выделить всё
df_X.filter(pl.col('dob')!="").groupby(['last_name','first_name','dob']).agg(pl.count())
Есть ли другое решение?
Подробнее здесь: https://stackoverflow.com/questions/742 ... hon-polars