Ввод, который я получаю, выглядит следующим образом (это отдельные буквы):






Сначала я подсчитывал количество черных пикселей на изображение и использовал это как способ идентификации различных букв, что довольно хорошо работало для контролируемых входных изображений. Проблема, однако, заключается в том, что я не могу заставить эту работу работать с изображениями, которые немного отличаются от этих.
У меня есть около 5 образцов каждой буквы для обучения, и этого должно быть достаточно.
Кто-нибудь знает, какой хороший алгоритм можно было бы использовать для этого?
Мои идеи были (после нормализации изображения):
- Подсчет разницы между изображением и изображением каждой буквы, чтобы определить, какое из них дает наименьшее количество ошибок. Однако это не сработает для больших наборов данных.
- Обнаружение углов и сравнение относительных местоположений.
- ???