Использование PandaShift и Rolling для модели MLPython

Программы на Python
Anonymous
Использование PandaShift и Rolling для модели ML

Сообщение Anonymous »

Я создаю программу машинного обучения для прогнозирования футбольных матчей. Одной из функций, которую я хочу использовать для обучения программы, является среднее количество голов, забитых командой в последних 5 играх. У меня есть DataFrame pandas, который, помимо прочего, содержит эту информацию. когда я просто использую Rolling(n).mean(), цели игры, которые я пытаюсь предсказать (для обучения модели), также используются для расчета среднего значения последних 5 игр. Я пытался использовать сдвиг (1) перед прокаткой (), но затем данные смещаются вниз (как и ожидалось) и заменяются NaN. Из-за этого количество значений становится слишком маленьким, поэтомуroll(n) автоматически переходит на следующую строку, и у меня снова возникает та же проблема.
Заранее спасибо!
df = pd.read_csv("D1.csv")
n=5
df["FTHG"].shift(1).rolling(n).mean()

Вернуться в «Python»