У меня есть Dataframe, столбец которого содержит идентификатор. Этот идентификатор представляет человека и может присутствовать много раз:
col_id col2 col3 col4....
row1 1
row2 1
row3 2
row4 3
row5 3
row6 3
row7 1
row8 7
Мне нужно вернуть новый фрейм данных, в котором значение value_counts столбца ID больше, скажем, 2.
Новый фрейм данных:
col_id col2 col3 col4....
row1 1
row2 1
row3 3
row4 3
row5 3
row6 1
Этот новый фрейм данных содержит только строки, в которых количество идентификаторов больше 2.
Изменить< /strong>
Здесь мне нужно разделить данные по идентификатору. В идеале мне хотелось бы найти решение, в котором у меня есть фрейм данных для каждого идентификатора:
Dataframe 1
col_id col2 col3 col4....
r1 1
r2 1
r3 1
Кадр данных 2
col_id col2 col3 col4....
r1 2
r2 2
r3 2
Кадр данных 3
col_id col2 col3 col4....
r1 3
r2 3
r3 3
Можно ли объединить их в один большой фрейм данных? Таким образом, я могу создать новый столбец под названием «индекс», в котором будут храниться строки для ID==1, ID==2 и т. д.:
index
1 col_id col2 col3 col4....
r1 1
r2 1
r3 1
index
2 col_id col2 col3 col4....
r1 2
r2 2
r3 2
index
3 col_id col2 col3 col4....
r1 3
r2 3
r3 3
Подробнее здесь: https://stackoverflow.com/questions/551 ... ter-than-x