Ошибка при попытке извлечь текст из файла PDF с помощью pdfminer.sixPython

Программы на Python
Anonymous
Ошибка при попытке извлечь текст из файла PDF с помощью pdfminer.six

Сообщение Anonymous »

Я пытаюсь извлечь текст из pdf с помощью библиотеки pdfminer.six (как здесь), я уже установил ее в своей виртуальной среде. вот мой код:

Код: Выделить всё

import pdfminer as miner

text = miner.high_level.extract_text('file.pdf')

print(text)
но когда я выполняю код с помощью python pdfreader.py, я получаю следующую ошибку:

Код: Выделить всё

Traceback (most recent call last):
File ".\pdfreader.py", line 9, in 
text = miner.high_level.extract_text('pdfBulletins/corona1.pdf')
AttributeError: module 'pdfminer' has no attribute 'high_level'
Я подозреваю, что это как-то связано с путем Python, потому что я установил pdfminer внутри своей виртуальной среды, но я вижу, что это установило pdf2txt.py снаружи в моей системе установлен Python. Нормально ли такое поведение? Я имею в виду, что то, что происходит внутри моего venv, не должно изменять установку Python в моей системе.
Я успешно извлек текст с помощью утилиты pdf2txt.py, которая поставляется с pdfminer. Six (из командной строки и с помощью установки системы Python), но не из кода внутри моего проекта venv. Моя версия pdfminer.six: 20201018
В чем может быть проблема с моим кодом?

Подробнее здесь: https://stackoverflow.com/questions/647 ... fminer-six

Вернуться в «Python»