Проблемы с парсингом веб-страниц Python: неполное извлечение HTML-кодаPython

Программы на Python
Гость
Проблемы с парсингом веб-страниц Python: неполное извлечение HTML-кода

Сообщение Гость »


Я новичок в Python, и в настоящее время у меня возникают проблемы с очисткой кода. Скрипт успешно получает доступ к веб-сайту и избегает файлов cookie. Однако, к сожалению, он не копирует весь HTML-код.

Это полная часть HTML-кода сайта:

Arbeitsatmosphäre Динамический

А это извлеченный код:

Рабочая атмосфера Динамический

Это код, который я уже пытался извлечь:

url = "https://www.kununu.com/de/adidas/kommentare" драйвер = вебдрайвер.Chrome() driver.get(url) [...] show_more_reviews(driver, 5) #Код нажимает «Читать больше отзывов» make_mini_scores_visible(driver) #Code показывает все «Мини-счета», такие как «Arbeitsatmosphäre» all_reviews = driver.execute_script("return document.documentElement.innerHTML;") суп = BeautifulSoup(html, 'html.parser') Важно, чтобы был извлечен весь код, поскольку мне нужна каждая порция информации.

Заранее спасибо!

Вернуться в «Python»