Я пытаюсь пометить метаданные на уровне документа в своих документах в Python, но каждый найденный мной загрузчик разбивает документ по страницам.
Есть ли какая-нибудь библиотека или метод, который я могу использовать? загрузить весь документ?
Любая помощь будет очень признательна, спасибо!
Я пробовал такие библиотеки, как PyPDF2, загружал через PyPDFLoader на langchain и другая библиотека PDF
Я надеялся, что смогу загрузить как 1 документ, но они всегда отображаются в виде списка документов.
Подробнее здесь: https://stackoverflow.com/questions/788 ... e-document