Точная классификация двоичных изображенийPython

Программы на Python
Anonymous
Точная классификация двоичных изображений

Сообщение Anonymous »

Я пытаюсь извлечь буквы из игрового поля для проекта. В настоящее время я могу обнаружить игровое поле, разбить его на отдельные квадраты и извлечь изображения каждого квадрата.

Ввод, который я получаю, выглядит следующим образом (это отдельные буквы):

Изображение

Изображение

Изображение

Изображение

Изображение

Изображение


Сначала я подсчитывал количество черных пикселей на изображение и использовал это как способ идентификации различных букв, что довольно хорошо работало для контролируемых входных изображений. Проблема, однако, заключается в том, что я не могу заставить эту работу работать с изображениями, которые немного отличаются от этих.

У меня есть около 5 образцов каждой буквы для обучения, и этого должно быть достаточно.

Кто-нибудь знает, какой хороший алгоритм можно было бы использовать для этого?

Мои идеи были (после нормализации изображения):
  • Подсчет разницы между изображением и изображением каждой буквы, чтобы определить, какое из них дает наименьшее количество ошибок. Однако это не сработает для больших наборов данных.
  • Обнаружение углов и сравнение относительных местоположений.
  • ???
Будем благодарны за любую помощь!

Вернуться в «Python»