Проблема с частичным обнаружением страниц с помощью Nougat OCRPython

Программы на Python
Anonymous
Проблема с частичным обнаружением страниц с помощью Nougat OCR

Сообщение Anonymous »

Я использую модель Nougat OCR для преобразования математических уравнений в латексный формат. Проблема, с которой я столкнулся, заключается в том, что некоторые страницы не полностью распознаются моделью Nougat OCR. Во многих случаях обнаруживается только половина контента на странице, а остальная часть пропускается. Однако на других страницах обнаружение работает отлично.
Шаги по воспроизведению:
  • < li>Преобразуйте PDF-файл в изображения (по одному изображению на страницу).
  • Обрабатывайте каждое изображение с использованием модели Nougat OCR индивидуально.
  • Обратите внимание, что на некоторых страницах частично обнаруживаются, а другие обрабатываются правильно.
(Это блокнот, который я слежу за выводами)
Пример результатов:
Первая страница

Код: Выделить всё

## Answers (LC2020 HL, P2):

1. \(0\); \(A\), \(B\) and \(C\) are collinear [0, 4, 7, 11, 15]
2. \(33\cdot 435^{\circ}\)[0, 4, 7, 11, 15]
3. \(9\)[0, 4, 7, 11, 15]
4. \(x^{2}+y^{2}+4x-21=0\), \(x^{2}+y^{2}-8x-9=0\)[0, 4, 7, 11, 15]
5. \(6\cdot 44\) m [0, 4, 7, 11, 15]
6. \(k=9\)[0, 4, 7, 11, 15]
7. \(\frac{5\pi}{3}\), \(
Вторая страница

Код: Выделить всё

## Answers (LC 2019 HL, P2):

1. (i) \(\frac{48}{95}\) [**0, 4, 7, 10**], (ii) \(\frac{88}{969}\) [**0, 4, 5, 8, 10**]
2. 1400 [**0, 4, 7, 10**]
3. Show [**0, 4, 7, 10**]
4. (i) \(mx-y-6m=0\) [**0, 2, 5**], (ii) \(P\bigg{(}\frac{18m+25}{3m+4}\), \(\frac{m}{3m+4}\bigg{)}\) [**0, 4, 7, 11, 15**]

1. \(k=-4\), 10 [**0, 4, 7, 10**]
2. \(s\): \(x^{2}+y^{2}-2x-2y+1=0\) [**0, 5, 10, 15, 20**]
3. Show [**0, 2, 3, 5**]
4. \(\frac{1}{3}\) [**0, 5, 10, 15, 20**]
5. Construction [**0, 4, 7, 11, 15**]
6. \(30^{\circ
Ожидаемое поведение. Модель OCR должна последовательно обнаруживать все части каждой страницы, а не только часть контента.
Вопрос. Необходимо ли выполнить какую-либо предварительную обработку, чтобы обеспечить полное обнаружение страницы? Или есть определенные параметры, которые следует настроить в Nougat OCR, чтобы улучшить результаты?

Подробнее здесь: https://stackoverflow.com/questions/789 ... nougat-ocr

Вернуться в «Python»