Я работаю над чем-то, что использует OCR для развлечения. В настоящее время я использую PyTesseract, и у него очень высокий уровень ошибок, поэтому я создал функцию проверки пользователя, чтобы можно было проверить вставленный текст. Когда я тестировал разные вещи, мне надоело вручную вводить одну из строк, в которой PyTesseract постоянно ошибался, поэтому я взял фрагмент и использовал функцию извлечения текста в инструменте для вырезания. У него была 100% точность.
Это заставило меня задуматься: если бы я мог просто найти способ заставить Python вызывать инструмент для обрезки, это бы а) увеличило точность оптического распознавания символов. Б) устранить необходимость в том, чтобы люди, использующие эту штуку, устанавливали Tesseract-OCR, чтобы их локальный Python мог запускать код.
Я хоть убей не могу понять, как это сделать хотя это возможно, или если это вообще возможно. Я читал здесь кое-что о том, как сделать снимок экрана в PowerShell, но это только половина моей проблемы. Любая помощь будет полезна.
Код, который у меня сейчас есть, находится по адресу https://github.com/MElse1/Puzzle-Solvin ... yTesseract. %20testing.py он запутанный и, вероятно, плохо сделан, но он выполняет свою работу, даже если он очень неточный из-за решения OCR.
Поскольку я связал свой github, это не для что-то серьезное, это просто способ улучшить логику программирования, что мне доставляет удовольствие. В конечном итоге это решение предназначено для решения проблемы поиска слов. Логическая часть программы хранится где-то в моем GitHub, но я подумал, что было бы здорово использовать OCR для создания списков для поиска слов.
Подробнее здесь: https://stackoverflow.com/questions/782 ... it-perform