Как игнорировать столбцы значений EMPTY/NULL при группировке в полях Python? ⇐ Python

Программы на Python
Anonymous
Как игнорировать столбцы значений EMPTY/NULL при группировке в полях Python?

Сообщение Anonymous »

У меня есть фрейм данных.

Код: Выделить всё

df_X = pl.DataFrame({'last_name':['James','Warner','Marino','James','Warner','Marino','James'],
'first_name':['Horn','Bro','Kach','Horn','Bro','Kach','Horn'],
'dob':['03/06/1990','09/16/1990','03/06/1990','','03/06/1990','','']}
)
Изображение

Я применяю группировку к столбцам «последний», «первый» и «dob», чтобы получить значения в виде

Код: Выделить всё

df_X.groupby(['last_name','first_name','dob']).agg(pl.count())
Изображение

Здесь я хотел бы игнорировать значения NULL/EMPTY при группировке столбцов, поскольку
У Джеймса Хорна есть два пустых DOB, их не следует включать в операцию группировки.
Вот ожидаемый результат.
Изображение
< /p>
Конечно, мы можем отфильтровать столбец, как показано ниже, прежде чем перейти к группировке как

Код: Выделить всё

df_X.filter(pl.col('dob')!="").groupby(['last_name','first_name','dob']).agg(pl.count())

Но что, если мне нужно указать 10 столбцов в операции фильтра? мне нужно написать их один за другим.
Есть ли другое решение?

Подробнее здесь: https://stackoverflow.com/questions/742 ... hon-polars

Вернуться в «Python»