Настройка Pycaret для одного горячего кодированияPython

Программы на Python
Anonymous
Настройка Pycaret для одного горячего кодирования

Сообщение Anonymous »

У меня возникла проблема с одной горячей кодировкой категориальных переменных в Pycaret. Проблема в том, что даже при установке моих категориальных переменных конвейер применяет нормализацию к категориальным переменным, и я понятия не имею, что я делаю неправильно.
Поначалу, используя приведенный ниже код, все работает. нормально:

Код: Выделить всё

from pycaret.classification import *
from pycaret.datasets import get_data
import pandas as pd
import numpy as np
import seaborn as sns
dataset = get_data('income')
dataset.dtypes
Пока я не начну установку и

Код: Выделить всё

exp_clf01 = setup(  data = dataset
, target = 'income >50K'
, session_id = 123
, numeric_features = ['age','education-num','capital-gain','capital-loss','hours-per-week']
, categorical_features = ['workclass','education','marital-status','occupation','relationship','race','sex','native-country']
)
df_transformed = get_config("X_train")
df_transformed.head()
После попытки просмотра заголовка фрейма данных он применяет только одно горячее кодирование к гонке столбцов и нормализует остальные категориальные входные данные, и я не могу понять, почему.< /p>




возраст
рабочий класс
образование
номер образования
семейное положение
род занятий
другие столбцы




46.0
0.303273
0.271186
11,0
0,101942
0,484643
...


27,0
0,218620
0,412939< /td>
13,0
0,044165
0,484643
...< /td>


33,0
0,218557
0,568315
14,0
0,448894
0,455449
...


60,0
0,218557
0.412673
13.0
0.448894
0.484286
.. .


25,0
0,218620
0,063798
6,0
0,044165
0,229692
. ..




Как я могу это предотвратить поведение?

Подробнее здесь: https://stackoverflow.com/questions/740 ... t-encoding

Вернуться в «Python»