Мне нужно очистить данные с этой веб-страницы: http://www.mlsa.am/?page_id=368. Это раскрывающийся список, в котором доступны следующие варианты: «Регионы», «Области», «Сообщества», «Тип субсидии», «Месяц» и «Год». После выбора этих опций появляется таблица с информацией о жителях этих мест, которые получают различные виды субсидий. Трудности, с которыми я сталкиваюсь в настоящее время при его очистке, заключаются в том, что поле «Области» зависит от того, какой «Регион» я выбираю, а «Сообщества» зависит от них обоих.
Вот как выглядит веб-страница, когда Просматриваю, эта информация
принадлежит ячейке «Регионы» (первый вариант):
`
Մարզեր *
Ընտրել
ԱՐԱԳԱԾՈՏՆ`
ԱՐԱՐԱՏ
ԱՐՄԱՎԻՐ
ԳԵՂԱՐՔՈՒՆԻՔ
ԼՈՌԻ
ԿՈՏԱՅՔ
ՇԻՐԱԿ
ՍՅՈՒՆԻՔ
ՎԱՅՈՑ ՁՈՐ
ՏԱՎՈՒՇ
ԵՐԵՎԱՆ`
Я использую селен с Python, и на данный момент это мой код:
`import time
import requests
from selenium import webdriver
from selenium.common.exceptions import WebDriverException
from selenium.common.exceptions import TimeoutException
from selenium.webdriver.common.keys import Keys
chrome_path = r"C:\Users\ivrav\selenium-2.25.0\Driver\chromedriver.exe"
driver = webdriver.Chrome(chrome_path)
print("loading url into browser...")
def get_all_pages():
payload={'value':'1'}
driver.get("http://www.mlsa.am/?page_id=368")
print(url.text)
time.sleep(2)`
Подробнее здесь: https://stackoverflow.com/questions/587 ... ith-python