Я пытаюсь запустить алгоритм машинного обучения в наборе данных с помощью scikit-learn. В моем наборе данных есть некоторые функции, похожие на категории. Например, одна из характеристик — A, которая имеет значения 1,2,3, определяющие качество чего-либо. 1: Высший, 2: Второй, 3: Третий класс. Итак, это порядковая переменная.
Аналогично я перекодировал переменную City, имеющую три значения («Лондон», «Цюрих», «Нью-Йорк», в 1, 2,3, но без особых предпочтений в отношении значений. Итак, теперь это номинальная категориальная переменная
Как мне указать алгоритм, который будет рассматривать их как. категориальный, порядковый и т. д. в pandas? Как и в R, категориальная переменная задается фактором (a) и, следовательно, не считается непрерывным значением в pandas/python?
Подробнее здесь: https://stackoverflow.com/questions/295 ... ategorical