Я я использую PyPDF для загрузки и объединения PDF-файлов. (Я также использую FPDF для создания PDF-страниц из файлов изображений, но, похоже, это не имеет отношения к этой проблеме).
Это почти всегда работает нормально.
Однако для одного конкретного исходного PDF-файла это не работает. Он содержит две страницы, и изображение на второй странице выглядит хорошо, когда я открываю его в программе просмотра PDF-файлов, но после включения его в полученный (объединенный) PDF-файл оно выглядит очень «размытым». Я пробовал несколько программ просмотра PDF-файлов как в Linux, так и в Windows, включая Acrobat, evince, qpdfview и Google Docs.
Я не понимаю, как это может произойти. Я прочитал PDF с
Код: Выделить всё
all_pages = PdfReader(pdf_path).pages
Код: Выделить всё
writer = PdfWriter()
for page in all_pages:
writer.add_page(page)`
Файлы PDF
исходный PDF
Результат после слиянияЯ провел всевозможные эксперименты, чтобы понять, смогу ли я это понять. В частности, я извлек изображение с помощью
Код: Выделить всё
pdf_page.images[0].image
Если кто-нибудь знает, как это сделать Я могу сделать так, чтобы исходное изображение отображалось неизмененным в «объединенном» PDF-файле, было бы очень здорово.
Это кажется связанным, но полезных ответов нет.
Извлечь изображения из PDF без повторной выборки в Python?
Подробнее здесь: https://stackoverflow.com/questions/785 ... ight-image