Проблемы с парсингом веб-страниц Python: неполное извлечение HTML-кода ⇐ Python
-
Гость
Проблемы с парсингом веб-страниц Python: неполное извлечение HTML-кода
Я новичок в Python, и в настоящее время у меня возникают проблемы с очисткой кода. Скрипт успешно получает доступ к веб-сайту и избегает файлов cookie. Однако, к сожалению, он не копирует весь HTML-код.
Это полная часть HTML-кода сайта:
Arbeitsatmosphäre Динамический
А это извлеченный код:
Рабочая атмосфера Динамический
Это код, который я уже пытался извлечь:
url = "https://www.kununu.com/de/adidas/kommentare" драйвер = вебдрайвер.Chrome() driver.get(url) [...] show_more_reviews(driver, 5) #Код нажимает «Читать больше отзывов» make_mini_scores_visible(driver) #Code показывает все «Мини-счета», такие как «Arbeitsatmosphäre» all_reviews = driver.execute_script("return document.documentElement.innerHTML;") суп = BeautifulSoup(html, 'html.parser') Важно, чтобы был извлечен весь код, поскольку мне нужна каждая порция информации.
Заранее спасибо!
Я новичок в Python, и в настоящее время у меня возникают проблемы с очисткой кода. Скрипт успешно получает доступ к веб-сайту и избегает файлов cookie. Однако, к сожалению, он не копирует весь HTML-код.
Это полная часть HTML-кода сайта:
Arbeitsatmosphäre Динамический
А это извлеченный код:
Рабочая атмосфера Динамический
Это код, который я уже пытался извлечь:
url = "https://www.kununu.com/de/adidas/kommentare" драйвер = вебдрайвер.Chrome() driver.get(url) [...] show_more_reviews(driver, 5) #Код нажимает «Читать больше отзывов» make_mini_scores_visible(driver) #Code показывает все «Мини-счета», такие как «Arbeitsatmosphäre» all_reviews = driver.execute_script("return document.documentElement.innerHTML;") суп = BeautifulSoup(html, 'html.parser') Важно, чтобы был извлечен весь код, поскольку мне нужна каждая порция информации.
Заранее спасибо!