У меня есть PDF-файл, содержащий текст и изображения. Все изображения имеют ALT-текст для чтения специальных возможностей.
Может ли кто-нибудь сказать мне, как я могу извлечь пары значений , где BufferedImage — это изображение, а String — это ALT-текст ?
Для меня не имеет значения, использую ли я PDFBox или Apache Tika.
Пример PDF: репозиторий GitHub с примером PDF >
Подробнее здесь: https://stackoverflow.com/questions/787 ... from-a-pdf