В настоящее время, используя mediapipe, я выполняю обнаружение поз и хочу классифицировать спортивные позы, но большинство поз похожи, и я использую классификацию поз, предоставленную самим tensorflow.
Проблема, с которой я столкнулся, заключается в том, что классификация выполняется для каждого кадра, что также приводит к ложному обнаружению, что также приводит к возможности правильной позы, а также к ложному обнаружению.
результат непрерывен, как будто необходимое действие, например, удар крикера по шести, происходит только в 23-м кадре и идентифицируется правильно, но я также получаю ложные обнаруженные действия в 25-м и 26-м кадре, чего я хочу избежать
Я пробовал корректировать данные, предоставлять расширенные данные, повышать надежность фильтрации, получать больше вложений, таких как углы, расстояния и т. д.
Подробнее здесь: https://stackoverflow.com/questions/790 ... sification