Как получить номер страницы закладки ⇐ Python
-
Anonymous
Как получить номер страницы закладки
при вводе списка импорта из PyPDF2 импортировать PdfFileReader из пункта назначения импорта PyPDF2.generic def get_outlines(pdf_filepath: str) -> Список[Назначение]: """Получить закладки PDF-файла.""" с open(pdf_filepath, "rb") в качестве fp: pdf_file_reader = PdfFileReader (fp) контуры = pdf_file_reader.getOutlines() вернуть контуры print(get_outlines("PDF-export-example.pdf")) pyPdf.pdf.Destination имеет множество свойств, но я не могу найти номер страницы, на которую ссылается эта закладка. Как я могу получить номер страницы закладок?
Например, outlines[1].page.idnum возвращает число, которое примерно в 3 раза больше, чем указанный номер страницы в PDF-документе, который, как я предполагаю, ссылается на какой-то объект, меньший, чем страница, при запуске < code>.page.idnum по всей структуре PDF-документа возвращает массив чисел, который даже не коррелирует линейно с «реальными» номерами страниц в PDF-документе и примерно кратен ~ 3
Обновление: этот вопрос аналогичен этому: разделить PDF-файл на основе схемы, хотя я не понимаю, что автор сделал в своем ответе. Мне кажется слишком сложным, чтобы его можно было использовать
при вводе списка импорта из PyPDF2 импортировать PdfFileReader из пункта назначения импорта PyPDF2.generic def get_outlines(pdf_filepath: str) -> Список[Назначение]: """Получить закладки PDF-файла.""" с open(pdf_filepath, "rb") в качестве fp: pdf_file_reader = PdfFileReader (fp) контуры = pdf_file_reader.getOutlines() вернуть контуры print(get_outlines("PDF-export-example.pdf")) pyPdf.pdf.Destination имеет множество свойств, но я не могу найти номер страницы, на которую ссылается эта закладка. Как я могу получить номер страницы закладок?
Например, outlines[1].page.idnum возвращает число, которое примерно в 3 раза больше, чем указанный номер страницы в PDF-документе, который, как я предполагаю, ссылается на какой-то объект, меньший, чем страница, при запуске < code>.page.idnum по всей структуре PDF-документа возвращает массив чисел, который даже не коррелирует линейно с «реальными» номерами страниц в PDF-документе и примерно кратен ~ 3
Обновление: этот вопрос аналогичен этому: разделить PDF-файл на основе схемы, хотя я не понимаю, что автор сделал в своем ответе. Мне кажется слишком сложным, чтобы его можно было использовать