Поначалу, используя приведенный ниже код, все работает. нормально:
Код: Выделить всё
from pycaret.classification import *
from pycaret.datasets import get_data
import pandas as pd
import numpy as np
import seaborn as sns
dataset = get_data('income')
dataset.dtypes
Код: Выделить всё
exp_clf01 = setup( data = dataset
, target = 'income >50K'
, session_id = 123
, numeric_features = ['age','education-num','capital-gain','capital-loss','hours-per-week']
, categorical_features = ['workclass','education','marital-status','occupation','relationship','race','sex','native-country']
)
df_transformed = get_config("X_train")
df_transformed.head()
возраст
рабочий класс
образование
номер образования
семейное положение
род занятий
другие столбцы
46.0
0.303273
0.271186
11,0
0,101942
0,484643
...
27,0
0,218620
0,412939< /td>
13,0
0,044165
0,484643
...< /td>
33,0
0,218557
0,568315
14,0
0,448894
0,455449
...
60,0
0,218557
0.412673
13.0
0.448894
0.484286
.. .
25,0
0,218620
0,063798
6,0
0,044165
0,229692
. ..
Как я могу это предотвратить поведение?
Подробнее здесь: https://stackoverflow.com/questions/740 ... t-encoding