Я хочу обучить свою собственную модель искусственного интеллекта, которая сможет извлекать текст из файлов PDF, в частности поддерживая арабский и французский языки.
Есть ли у кого-нибудь предложения о том, как я могу начать этот проект или какие инструменты, платформы или подходы мне следует использовать?