Я использую Selenium для просмотра сайтов и поиска текста, наложенного на изображение в формате html. Но у меня есть проблемы: как мне правильно идентифицировать наложенный текст на веб-странице уникальным способом, не принимая во внимание значки, логотипы и т. д.?
Я использую Selenium с ChromeDriver, посетите веб-сайт.
фильтрует изображения для удаления логотипов или значков, ищет перекрывающийся текст и собирает пары изображение-текст.
Проблема в том, что он неправильно определяет все атрибуты CSS для обнаружения перекрывающегося текста.
Подробнее здесь: https://stackoverflow.com/questions/786 ... -a-website