Как объединить строки со столбцом идентификатора в Python, чтобы создать одну строку ⇐ Python
-
Anonymous
Как объединить строки со столбцом идентификатора в Python, чтобы создать одну строку
Я завершил свой проект на 95 %, но у меня возникают проблемы с дубликатами, и я не понимаю, что такое дубликаты. Я бы хотел, чтобы они были объединены в одну строку.
**Окончательный результат в Excel выглядит так: **
Идентификатор P Идентификатор T Идентификатор C 1 квартал 2 квартал Q3 318 495 00036282 НЕТ 318 495 00036282 Да Все расходы покрыты 319 496 00036283 Да Без дополнительных затрат 319 496 00036283 Да
В настоящее время этот вывод содержит 3130 строк
**Как это должно выглядеть в Excel: **
Идентификатор P Идентификатор T Идентификатор C 1 квартал 2 квартал Q3 318 495 00036282 НЕТ Да Все расходы покрыты 319 496 00036283 Да Да Без дополнительных затрат
В моем идеальном выводе около 900 строк, и мне нужны все столбцы в конечном выводе.
На данный момент я пытался:
[*]Удаление дубликатов с помощью функции drop_duulates(). [*]Группировка по идентификатору свойства и объединение строк. [*]Объединение строк с похожими идентификаторами свойств с сохранением уникальных значений. [*]Вручную проверка набора данных на наличие каких-либо несоответствий или шаблонов (хотя я могу их обнаружить, это не может в достаточной степени решить проблему, поскольку для проверки требуется версия Excel, что контрпродуктивно с точки зрения автоматизации)
# Группировка по идентификатору P и агрегирование с использованием суммы для числовых столбцов df_FinalOutput_summed = df_FinalOutput.groupby('P Id').sum().reset_index() df_FinalOutput_summed df_FinalOutput = df_FinalOutput.groupby('P Id').agg({ 'T Id': 'последний', «C ID»: «последний», «Q1»: «последний» «Q2»: «последний» «Q3»: «последний» }).reset_index() # Сброс индекса после группировки df_FinalOutput.reset_index(drop=True, inplace=True) # Отобразить окончательный выходной DataFrame df_FinalOutput Этот фрагмент кода близок к тому, что мне нужно, но я не хочу просто выбирать последнюю строку, я хочу объединить строки и получить один столбец со всеми подробностями.
Я завершил свой проект на 95 %, но у меня возникают проблемы с дубликатами, и я не понимаю, что такое дубликаты. Я бы хотел, чтобы они были объединены в одну строку.
**Окончательный результат в Excel выглядит так: **
Идентификатор P Идентификатор T Идентификатор C 1 квартал 2 квартал Q3 318 495 00036282 НЕТ 318 495 00036282 Да Все расходы покрыты 319 496 00036283 Да Без дополнительных затрат 319 496 00036283 Да
В настоящее время этот вывод содержит 3130 строк
**Как это должно выглядеть в Excel: **
Идентификатор P Идентификатор T Идентификатор C 1 квартал 2 квартал Q3 318 495 00036282 НЕТ Да Все расходы покрыты 319 496 00036283 Да Да Без дополнительных затрат
В моем идеальном выводе около 900 строк, и мне нужны все столбцы в конечном выводе.
На данный момент я пытался:
[*]Удаление дубликатов с помощью функции drop_duulates(). [*]Группировка по идентификатору свойства и объединение строк. [*]Объединение строк с похожими идентификаторами свойств с сохранением уникальных значений. [*]Вручную проверка набора данных на наличие каких-либо несоответствий или шаблонов (хотя я могу их обнаружить, это не может в достаточной степени решить проблему, поскольку для проверки требуется версия Excel, что контрпродуктивно с точки зрения автоматизации)
# Группировка по идентификатору P и агрегирование с использованием суммы для числовых столбцов df_FinalOutput_summed = df_FinalOutput.groupby('P Id').sum().reset_index() df_FinalOutput_summed df_FinalOutput = df_FinalOutput.groupby('P Id').agg({ 'T Id': 'последний', «C ID»: «последний», «Q1»: «последний» «Q2»: «последний» «Q3»: «последний» }).reset_index() # Сброс индекса после группировки df_FinalOutput.reset_index(drop=True, inplace=True) # Отобразить окончательный выходной DataFrame df_FinalOutput Этот фрагмент кода близок к тому, что мне нужно, но я не хочу просто выбирать последнюю строку, я хочу объединить строки и получить один столбец со всеми подробностями.