df=pd.DataFrame({'Name':['A','A','A','A','B','B','B','B'],
'Pair':['b','c','d','e','b','f','d','g'],
'List':['1,2','2,3,4',np.nan,'5',np.nan,'1,2,3','3,6','5,4']})
Мой вывод, по сути, я хочу разделить «Пару» и «Список» на цифры и соединить их.
- < li>'Уникальная пара': сгруппируйте по каждому имени, разделите его, отбросьте NA, объедините все уникальные буквы и отсортируйте буквы.
- 'Уникальный элемент': та же логика, что и для 'Уникальная пара'
- 'Все элементы': единственное отличие состоит в том, что он не объединяется уникальные буквы, но все буквы появились и сортируются по буквам. Например, для имени A есть две цифры «2», поэтому оно появляется дважды.
'Unique Pair':['b,c,d,e','b,d,f,g'],
'Unique Item':['1,2,3,4,5','1,2,3,4,5,6'],
'All Item':['1,2,2,3,4,5','1,2,3,3,4,5,6']})
Я пробовал это, но не знаю, как соединить все элементы вместе.
df.groupby('Name')['List'].fillna('NA').apply(lambda x: x.split(','))
Подробнее здесь: https://stackoverflow.com/questions/790 ... per-entity