У меня есть фрейм данных с неоднократно встречающимися строками с разными именами. Я хочу удалить меньше встречающихся строк. Мой фрейм данных очень большой. Здесь я указываю только небольшой размер.
dataframe:
df =
name value
0 A 10
1 B 20
2 A 30
3 A 40
4 C 50
5 C 60
6 D 70
В приведенном выше фрейме данных строки B и D встречались меньшее количество раз. Это меньше 1. Я хочу удалить все такие строки, число которых меньше 2.
Мой код:
##### Net strings
net_strs = df['name'].unique().tolist()
strng_list = df.group.unique().tolist()
tempdf = df.groupby('name').count()
##### strings that have less than 2 measurements in whole data set
lesstr = tempdf[tempdf['value']