Поиск предложений по улучшению моделей NER в анализе ADEPython

Программы на Python
Anonymous
Поиск предложений по улучшению моделей NER в анализе ADE

Сообщение Anonymous »

В настоящее время я работаю над магистерской диссертацией, которая является второй частью серии. В первой части моей дипломной работы, озаглавленной «Обнаружение нежелательных явлений, связанных с приемом лекарств, с использованием методов НЛП», я попытался воспроизвести результаты статьи, но мне пришлось адаптировать методологию к другому набору данных (n2c2) из-за ограничений доступности данных. Мое внимание было сосредоточено на распознавании названных объектов (NER) для выявления побочных эффектов лекарств (ADE) в клинических текстах, где я доработал модель DeBERTa.
Поскольку это мой первый путь в академическую сферу исследования, я столкнулся с проблемами с точностью модели и ищу современные подходы для улучшения своих результатов. Я пришел к следующим вариантам:
Методы увеличения данных.
Расширенная архитектура моделей или стратегии точной настройки.
Интеграция внешних баз медицинских знаний для улучшения понимания контекста.
Если у кого-то есть опыт проведения подобных исследований или понимание последних достижений НЛП в медицинской сфере, ваш вклад будет неоценим. Кроме того, если есть общие ошибки или важные соображения, о которых следует знать начинающему автору диссертации, я с нетерпением жду возможности узнать об этом.
Для справки: моя текущая работа основана на первоначальных исследованиях. бумажный текст, и я адаптировал его к нюансам набора данных n2c2.
Заранее спасибо за ваше время и помощь!
Я попробовал чтобы воспроизвести результаты предыдущего исследования, но столкнулись с проблемами с точностью ниже ожидаемой. Вот что я пробовал:
Точная настройка DeBERTa со стандартными гиперпараметрами в наборе данных n2c2.
Базовая предварительная обработка данных для задач NER (токенизация, BIO-теги).
Я ожидал получить результаты, сопоставимые с результатами первоначального исследования, в котором использовался другой набор данных, но эффективность моей модели отстает, особенно в плане точности и полноты.

Подробнее здесь: https://stackoverflow.com/questions/783 ... e-analysis

Вернуться в «Python»