Я пытаюсь реализовать модель классификации по нескольким меткам. Набор данных очень мал, у меня всего 900 строк, и набор данных не содержит изображений. Это похоже на классификацию тегов. У меня есть 12 столбцов, представляющих мой y, которые могут одновременно принимать значения 0 и 1. Проблема в том, что для некоторых столбцов частота значения 1 составляет менее 4 %.
Итак, я искал методологию передискретизации и наткнулся на статью, описывающую MLSMOTE. метод, но он не очень хорошо работает с моими данными. Кто-нибудь из вас уже сталкивался с подобной проблемой? Я использую несколько многообучаемых библиотек scikit, но ни одна из них не работает для передискретизации. Кроме того, библиотека imblearn не решает проблемы классификации по нескольким меткам.
Спасибо всем, кто мне ответит.
Подробнее здесь: https://stackoverflow.com/questions/786 ... -y-classes