Улучшение распознавания текста при наличии наложенных линий

Улучшение распознавания текста при наличии наложенных линий ⇐ Python

1 сообщение • Страница 1 из 1

Anonymous

Улучшение распознавания текста при наличии наложенных линий

Быстрая цитата

Сообщение Anonymous » 28 апр 2024, 03:52

Это простая программа оптического распознавания символов (OCR) на Python 3 для получения строки. Я загрузил здесь целевой файл gif, загрузите его и сохраните как /tmp/target.gif.

Код: Выделить всё

try:
from PIL import Image
except ImportError:
import Image
import pytesseract
print(pytesseract.image_to_string(Image.open('/tmp/target.gif')))

Я вставляю сюда всю информацию об ошибках. Исправьте ее, чтобы получить символы из изображения.

Код: Выделить всё

/usr/lib/python3/dist-packages/PIL/Image.py:925: UserWarning: Couldn't allocate palette entry for transparency
"for transparency")
Traceback (most recent call last):
File "", line 1, in 
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 309, in image_to_string
}[output_type]()
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 308, in 
Output.STRING: lambda: run_and_get_output(*args),
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 208, in run_and_get_output
temp_name, input_filename = save_image(image)
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 136, in save_image
image.save(input_file_name, format=img_extension, **image.info)
File "/usr/lib/python3/dist-packages/PIL/Image.py", line 1728, in save
save_handler(self, fp, filename)
File "/usr/lib/python3/dist-packages/PIL/GifImagePlugin.py", line 407, in _save
_get_local_header(fp, im, (0, 0), flags)
File "/usr/lib/python3/dist-packages/PIL/GifImagePlugin.py", line 441, in _get_local_header
transparency = int(transparency)
TypeError: int() argument must be a string, a bytes-like object or a number, not 'tuple'

Я конвертирую его с помощью команды Convert в bash.

Код: Выделить всё

convert  "/tmp/target.gif"   "/tmp/target.jpg"

Здесь я показываю /tmp/target.gif и /tmp/target.jpg.

Затем снова выполните приведенный выше код Python.

Код: Выделить всё

try:
from PIL import Image
except ImportError:
import Image
import pytesseract
print(pytesseract.image_to_string(Image.open('/tmp/target.jpg')))

Я ничего не могу получить с помощью pytesseract.image_to_string(Image.open('/tmp/target.jpg')), я получаю пустой символ.< /p>

Для Код Trenton_M:

Код: Выделить всё

>>> img1 = remove_noise_and_smooth(r'/tmp/target.jpg')
Traceback (most recent call last):
File "", line 1, in 
File "", line 3, in remove_noise_and_smooth
AttributeError: 'NoneType' object has no attribute 'astype'
Thalish Sajeed

Для кода Талиша Саджида:

[img]https: //i.stack.imgur.com/LSY3r.png[/img]

Опустить информацию об ошибке, вызванной print(pytesseract.image_to_string(Image.open(filename)) ).

Код: Выделить всё

Type "help", "copyright", "credits" or "license" for more information.
>>> from PIL import Image
>>> import pytesseract
>>> import matplotlib.pyplot as plt
>>> import cv2
>>> import numpy as np
>>>
>>>
>>> def display_image(filename, length_box=60, width_box=30):
...     if type(filename) == np.ndarray:
...         image = filename
...     else:
...         image = cv2.imread(filename)
...     plt.figure(figsize=(length_box, width_box))
...     plt.imshow(image, cmap="gray")
...
>>>
>>> filename = r"/tmp/target.jpg"
>>> display_image(filename)
Traceback (most recent call last):
File "", line 1, in 
File "", line 7, in display_image
File "/usr/local/lib/python3.5/dist-packages/matplotlib/pyplot.py", line 2699, in imshow
None else {}), **kwargs)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/__init__.py", line 1810, in inner
return func(ax, *args, **kwargs)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/axes/_axes.py", line 5494, in imshow
im.set_data(X)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/image.py", line 634, in set_data
raise TypeError("Image data cannot be converted to float")
TypeError: Image data cannot be converted to float
>>>

@Thalish Sajeed, Почему я получил 9244K вместо 0244k с вашим кодом?
Вот мой проверенный образец файла.< /p>

извлеченная строка.

< /p>

@Trenton_M, исправьте небольшую опечатку и потерю в своем коде и удалите строку plt.show() по вашему предложению.

Код: Выделить всё

>>> import cv2,pytesseract
>>> import numpy as np
>>> import matplotlib.pyplot as plt
>>>
>>>
>>> def image_smoothening(img):
...     ret1, th1 = cv2.threshold(img, 88, 255, cv2.THRESH_BINARY)
...     ret2, th2 = cv2.threshold(th1, 0, 255, cv2.THRESH_BINARY + cv2.THRESH_OTSU)
...     blur = cv2.GaussianBlur(th2, (5, 5), 0)
...     ret3, th3 = cv2.threshold(blur, 0, 255, cv2.THRESH_BINARY + cv2.THRESH_OTSU)
...     return th3
...
>>>
>>> def remove_noise_and_smooth(file_name):
...     img = cv2.imread(file_name, 0)
...     filtered = cv2.adaptiveThreshold(img, 255, cv2.ADAPTIVE_THRESH_MEAN_C, cv2.THRESH_BINARY, 9, 41)
...     kernel = np.ones((1, 1), np.uint8)
...     opening = cv2.morphologyEx(filtered, cv2.MORPH_OPEN, kernel)
...     closing = cv2.morphologyEx(opening, cv2.MORPH_CLOSE, kernel)
...     img = image_smoothening(img)
...     or_image = cv2.bitwise_or(img, closing)
...     return or_image
...
>>>
>>> cv2_thresh_list = [cv2.THRESH_BINARY, cv2.THRESH_TRUNC, cv2.THRESH_TOZERO]
>>> fn = r'/tmp/target.jpg'
>>> img1 = remove_noise_and_smooth(fn)
>>> img2 = cv2.imread(fn, 0)
>>> for i, img in enumerate([img1, img2]):
...     img_type = {0: 'Preprocessed Images\n',
...                 1: '\nUnprocessed Images\n'}
...     print(img_type[i])
...     for item in cv2_thresh_list:
...         print('Thresh: {}'.format(str(item)))
...         _, thresh = cv2.threshold(img, 127, 255, item)
...         plt.imshow(thresh, 'gray')
...         f_name = '{0}.jpg'.format(str(item))
...         plt.savefig(f_name)
...         print('OCR Result: {}\n'.format(pytesseract.image_to_string(f_name)))

...
Предварительно обработанные изображения

В моей консоли вся выводимая информация выглядит следующим образом: :

Код: Выделить всё

Thresh: 0

OCR Result: 10
15
20

Edﬁﬁ
10
2 o 30 40 so
so

Thresh: 2

OCR Result: 10
15
20
Edﬁﬁ
10
2 o 30 40 so
so
Thresh: 3

OCR Result: 10
15
20
Edﬁﬁ
10
2 o 30 40 so
so
Unprocessed Images
Thresh: 0

OCR Result: 10
15
20
Thresh: 2

OCR Result: 10
15
2o
2o
30 40 50
Thresh: 3

OCR Result: 10
15
20

Где строка 0244R?

Подробнее здесь: https://stackoverflow.com/questions/571 ... rlay-lines

1714265561

Anonymous

Это простая программа оптического распознавания символов (OCR) на Python 3 для получения строки. Я загрузил здесь целевой файл gif, загрузите его и сохраните как /tmp/target.gif.

[img]https://i.stack.imgur.com/eZZkC.gif[/img]


[code]try:
from PIL import Image
except ImportError:
import Image
import pytesseract
print(pytesseract.image_to_string(Image.open('/tmp/target.gif')))
[/code]

Я вставляю сюда всю информацию об ошибках. Исправьте ее, чтобы получить символы из изображения.

[code]/usr/lib/python3/dist-packages/PIL/Image.py:925: UserWarning: Couldn't allocate palette entry for transparency
"for transparency")
Traceback (most recent call last):
File "", line 1, in 
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 309, in image_to_string
}[output_type]()
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 308, in 
Output.STRING: lambda: run_and_get_output(*args),
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 208, in run_and_get_output
temp_name, input_filename = save_image(image)
File "/usr/local/lib/python3.5/dist-packages/pytesseract/pytesseract.py", line 136, in save_image
image.save(input_file_name, format=img_extension, **image.info)
File "/usr/lib/python3/dist-packages/PIL/Image.py", line 1728, in save
save_handler(self, fp, filename)
File "/usr/lib/python3/dist-packages/PIL/GifImagePlugin.py", line 407, in _save
_get_local_header(fp, im, (0, 0), flags)
File "/usr/lib/python3/dist-packages/PIL/GifImagePlugin.py", line 441, in _get_local_header
transparency = int(transparency)
TypeError: int() argument must be a string, a bytes-like object or a number, not 'tuple'
[/code]

Я конвертирую его с помощью команды Convert в bash.

[code]convert  "/tmp/target.gif"   "/tmp/target.jpg"
[/code]

Здесь я показываю /tmp/target.gif и /tmp/target.jpg.
[img]https://i.stack.imgur.com/np19m.png[/img]


Затем снова выполните приведенный выше код Python.

[code]try:
from PIL import Image
except ImportError:
import Image
import pytesseract
print(pytesseract.image_to_string(Image.open('/tmp/target.jpg')))
[/code]

Я ничего не могу получить с помощью pytesseract.image_to_string(Image.open('/tmp/target.jpg')), я получаю пустой символ.< /p>

[img]https://i.stack.imgur.com/tqjjQ.png[/img]
Для Код Trenton_M:

[code]>>> img1 = remove_noise_and_smooth(r'/tmp/target.jpg')
Traceback (most recent call last):
File "", line 1, in 
File "", line 3, in remove_noise_and_smooth
AttributeError: 'NoneType' object has no attribute 'astype'
Thalish Sajeed
[/code]

Для кода Талиша Саджида:

[img]https: //i.stack.imgur.com/LSY3r.png[/img]


Опустить информацию об ошибке, вызванной print(pytesseract.image_to_string(Image.open(filename)) ). 

[code]Type "help", "copyright", "credits" or "license" for more information.
>>> from PIL import Image
>>> import pytesseract
>>> import matplotlib.pyplot as plt
>>> import cv2
>>> import numpy as np
>>>
>>>
>>> def display_image(filename, length_box=60, width_box=30):
...     if type(filename) == np.ndarray:
...         image = filename
...     else:
...         image = cv2.imread(filename)
...     plt.figure(figsize=(length_box, width_box))
...     plt.imshow(image, cmap="gray")
...
>>>
>>> filename = r"/tmp/target.jpg"
>>> display_image(filename)
Traceback (most recent call last):
File "", line 1, in 
File "", line 7, in display_image
File "/usr/local/lib/python3.5/dist-packages/matplotlib/pyplot.py", line 2699, in imshow
None else {}), **kwargs)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/__init__.py", line 1810, in inner
return func(ax, *args, **kwargs)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/axes/_axes.py", line 5494, in imshow
im.set_data(X)
File "/usr/local/lib/python3.5/dist-packages/matplotlib/image.py", line 634, in set_data
raise TypeError("Image data cannot be converted to float")
TypeError: Image data cannot be converted to float
>>>
[/code]

@Thalish Sajeed, Почему я получил 9244K вместо 0244k с вашим кодом?
Вот мой проверенный образец файла.< /p>

[img]https://i.stack.imgur.com/fiqRF.jpg[/img]
извлеченная строка.

[img]https://i.stack.imgur.com/adXCv.png[/img]
< /p>

@Trenton_M, исправьте небольшую опечатку и потерю в своем коде и удалите строку plt.show() по вашему предложению.

[code]>>> import cv2,pytesseract
>>> import numpy as np
>>> import matplotlib.pyplot as plt
>>>
>>>
>>> def image_smoothening(img):
...     ret1, th1 = cv2.threshold(img, 88, 255, cv2.THRESH_BINARY)
...     ret2, th2 = cv2.threshold(th1, 0, 255, cv2.THRESH_BINARY + cv2.THRESH_OTSU)
...     blur = cv2.GaussianBlur(th2, (5, 5), 0)
...     ret3, th3 = cv2.threshold(blur, 0, 255, cv2.THRESH_BINARY + cv2.THRESH_OTSU)
...     return th3
...
>>>
>>> def remove_noise_and_smooth(file_name):
...     img = cv2.imread(file_name, 0)
...     filtered = cv2.adaptiveThreshold(img, 255, cv2.ADAPTIVE_THRESH_MEAN_C, cv2.THRESH_BINARY, 9, 41)
...     kernel = np.ones((1, 1), np.uint8)
...     opening = cv2.morphologyEx(filtered, cv2.MORPH_OPEN, kernel)
...     closing = cv2.morphologyEx(opening, cv2.MORPH_CLOSE, kernel)
...     img = image_smoothening(img)
...     or_image = cv2.bitwise_or(img, closing)
...     return or_image
...
>>>
>>> cv2_thresh_list = [cv2.THRESH_BINARY, cv2.THRESH_TRUNC, cv2.THRESH_TOZERO]
>>> fn = r'/tmp/target.jpg'
>>> img1 = remove_noise_and_smooth(fn)
>>> img2 = cv2.imread(fn, 0)
>>> for i, img in enumerate([img1, img2]):
...     img_type = {0: 'Preprocessed Images\n',
...                 1: '\nUnprocessed Images\n'}
...     print(img_type[i])
...     for item in cv2_thresh_list:
...         print('Thresh: {}'.format(str(item)))
...         _, thresh = cv2.threshold(img, 127, 255, item)
...         plt.imshow(thresh, 'gray')
...         f_name = '{0}.jpg'.format(str(item))
...         plt.savefig(f_name)
...         print('OCR Result: {}\n'.format(pytesseract.image_to_string(f_name)))
[/code]

...
Предварительно обработанные изображения

В моей консоли вся выводимая информация выглядит следующим образом: :

[code]Thresh: 0

OCR Result: 10
15
20

Edﬁﬁ
10
2 o 30 40 so
so

Thresh: 2

OCR Result: 10
15
20
Edﬁﬁ
10
2 o 30 40 so
so
Thresh: 3

OCR Result: 10
15
20
Edﬁﬁ
10
2 o 30 40 so
so
Unprocessed Images
Thresh: 0

OCR Result: 10
15
20
Thresh: 2

OCR Result: 10
15
2o
2o
30 40 50
Thresh: 3

OCR Result: 10
15
20
[/code]

Где строка 0244R? 

Подробнее здесь: [url]https://stackoverflow.com/questions/57183997/improving-text-recognition-in-the-presence-of-overlay-lines[/url]

Ответить Пред. тема След. тема

1 сообщение • Страница 1 из 1

Быстрый ответ

Заголовок:

Имя пользователя:

Изменение регистра текста:

Смайлики

Ещё смайлики…

К этому ответу прикреплено по крайней мере одно вложение.

Если вы не хотите добавлять вложения, оставьте поля пустыми. Можно прикреплять файлы, перетаскивая их в окно сообщения.

Максимально разрешённый размер вложения: 15 МБ.

Похожие темы

Ответы

Просмотры

Последнее сообщение

Продукты WooCommerce, показывающие сообщение «Нет в наличии», хотя на самом деле их нет в наличии

Последнее сообщение Anonymous « 01 июн 2024, 21:35
Добавлено в форуме Php

Anonymous » 01 июн 2024, 21:35 » в форуме Php

Возникла проблема на клиентском веб-сайте, где товары отображаются случайным образом.

Этого товара сейчас нет в наличии, и он недоступен.

Дело в том, что у нас не включено отслеживание запасов, все товары должны быть в наличии постоянно....

0 Ответы

105 Просмотры

Последнее сообщение Anonymous
01 июн 2024, 21:35
Отображение продукта, который «в наличии» как «нет в наличии» для конкретного пользователя [закрыто]

Последнее сообщение Anonymous « 22 фев 2025, 03:41
Добавлено в форуме Php

Anonymous » 22 фев 2025, 03:41 » в форуме Php

Есть ли способ отобразить продукты, которые «в наличии» как «вне склада» для конкретного пользователя и на определенной странице, где только продукты «из запаса» отображаются в WordPress.

Подробнее здесь:

0 Ответы

9 Просмотры

Последнее сообщение Anonymous
22 фев 2025, 03:41
Обработка изображений: улучшение алгоритма распознавания банки Coca-Cola

Последнее сообщение Anonymous « 05 окт 2024, 10:50
Добавлено в форуме C++

Anonymous » 05 окт 2024, 10:50 » в форуме C++

Одним из самых интересных проектов, над которыми я работал за последние пару лет, был проект по обработке изображений. Целью была разработка системы, позволяющей распознавать банки Coca-Cola (обратите внимание, что я подчеркиваю слово «банки», через...

0 Ответы

11 Просмотры

Последнее сообщение Anonymous
05 окт 2024, 10:50
Обработка изображений: улучшение алгоритма распознавания банки Coca-Cola

Последнее сообщение Anonymous « 05 окт 2024, 16:46
Добавлено в форуме C++

Anonymous » 05 окт 2024, 16:46 » в форуме C++

Одним из самых интересных проектов, над которыми я работал за последние пару лет, был проект по обработке изображений. Целью была разработка системы, позволяющей распознавать банки Coca-Cola (обратите внимание, что я подчеркиваю слово «банки», через...

0 Ответы

12 Просмотры

Последнее сообщение Anonymous
05 окт 2024, 16:46
Как избавиться от линий на рисунке? И как я могу уменьшить количество линий, необходимых для создания рисунка?

Последнее сообщение Anonymous « 03 окт 2024, 23:29
Добавлено в форуме Python

Anonymous » 03 окт 2024, 23:29 » в форуме Python

Я пытаюсь создать код Python, который принимает изображение и преобразует его в JavaScript, чтобы мой Blot by Hack Club мог прочитать этот JS и создать это изображение. Документация по пятнам. В настоящее время мой код делает это, но рисует...

0 Ответы

30 Просмотры

Последнее сообщение Anonymous
03 окт 2024, 23:29

Вернуться в «Python»