Я пытался создать программу, которая могла бы использовать устройство захвата видео, например mss, чтобы затем читать текст на мониторе с помощью такой программы, как tesseract. Мне удалось создать устройство захвата видео с помощью mss. , но не могу понять, как создать область обнаружения текста в коде. Может ли кто-нибудь помочь мне с этим?
import numpy as np
import cv2
from mss import mss
from PIL import Image
bounding_box = {'top': 0, 'left': 0, 'width': 1920, 'height': 1080}
sct = mss()
while True:
sct_img = sct.grab(bounding_box)
cv2.imshow('screen', np.array(sct_img))
if cv2.waitKey(1) == ord('q'):
cv2.destroyAllWindows()
break
Подробнее здесь: https://stackoverflow.com/questions/787 ... -a-monitor