Получение ограничивающей рамки распознанных слов с помощью Python-tesseractPython

Программы на Python
Anonymous
Получение ограничивающей рамки распознанных слов с помощью Python-tesseract

Сообщение Anonymous »

Я использую python-tesseract для извлечения слов из изображения. Это оболочка Python для tesseract, который представляет собой код OCR.

Я использую следующий код для получения слов:

Код: Выделить всё

import tesseract

api = tesseract.TessBaseAPI()
api.Init(".","eng",tesseract.OEM_DEFAULT)
api.SetVariable("tessedit_char_whitelist", "0123456789abcdefghijklmnopqrstuvwxyz")
api.SetPageSegMode(tesseract.PSM_AUTO)

mImgFile = "test.jpg"
mBuffer=open(mImgFile,"rb").read()
result = tesseract.ProcessPagesBuffer(mBuffer,len(mBuffer),api)
print "result(ProcessPagesBuffer)=",result
Это возвращает только слова, а не их расположение/размер/ориентацию (или, другими словами, ограничивающую рамку, содержащую их) на изображении. Мне было интересно, есть ли какой-нибудь способ получить это тоже

Подробнее здесь: https://stackoverflow.com/questions/208 ... -tesseract

Вернуться в «Python»