У меня есть собственный набор данных, который я загрузил в фрейм данных, и я хочу использовать AIF360 для честного машинного обучения.
Я всегда оперативно кодирую категориальные функции с помощью метода get_dummies() из pandas.< /p>
Нужно ли мне использовать класс BinaryLabelDataset для данных с горячим кодированием, а класс StandardDataset также предназначен для пользовательских наборов данных, но которые еще не были подвергнуты горячему кодированию?
/>По сути, я не уверен, какой класс использовать в каком случае (для фрейма данных с горячим кодированием = BinaryLabelDataset? - для фрейма данных без преобразований = StandardDataset?)Я прочитал документацию AIF360 и справочное руководство по API. Однако мне не совсем ясно, какой из них мне следует использовать.
Я знаю, что класс BinaryLabelDataset основан на классе StandardDataset.
Кроме того, класс StandardDataset также может выполнять некоторые преобразования данных.Кроме того, есть совместимый со sklearn API, который я мог бы использовать.
Подробнее здесь: https://stackoverflow.com/questions/785 ... -dataframe