Парсинг веб-страниц в разных форматахPython

Программы на Python
Anonymous
Парсинг веб-страниц в разных форматах

Сообщение Anonymous »

Я пытаюсь получить имена, адреса электронной почты (связанные с их именем), годы и роли/предметы сотрудников на этой странице https://www.aacps.org/Page/4014 и сохранить данные. в листе Excel. Возникли трудности со сбором данных о ссылках, а также текстовой информации.
Вот что у меня пока:

Код: Выделить всё

url_fac='https://www.aacps.org/Page/4014'
print(url_fac)
req_fac = urllib.request.Request(url_fac, headers=hdr)
html_page_fac = urllib.request.urlopen(req_fac)
soup_fac = BeautifulSoup(html_page_fac, "lxml")
links_fac=soup_fac.find_all('a')
Заранее большое спасибо!

Подробнее здесь: https://stackoverflow.com/questions/635 ... nt-formats

Вернуться в «Python»