В Excel, когда я хочу суммировать значения по таблице, я могу выполнить суммирование, если условие исключается на основе имени переменной. Есть ли у Pandas аналогичная функция?
Чтобы дать больше контекста, я смотрю на матрицу путаницы и определяю процент правильных и неправильных классификаций
Пример Excel
Fantasy Horror RPG
Fantasy 25 3 1
Horror 1 13 0
RPG 11 1 7
==(sum(B2:B4) - SUMIF($A2:$A4,""&B$1,B2:B4))/sum(B2:B4)
Результаты:
0.68 0.76 0.88
Я знаю о функции groupby, но, насколько я понимаю, она группируется на основе категориальных переменных, а не путем исключения, как это можно сделать с помощью sumif.< /p>
Пример:
import pandas as pd
my_data: pd.DataFrame = pd.read_excel("c:/mydata.xlsx")
mydata.groupby("genre").count()
Подробнее здесь: https://stackoverflow.com/questions/787 ... sion-sumif