если полезно, у этих элементов div тоже есть класс.
Я пробовал
Код: Выделить всё
from selenium import webdriver
from bs4 import BeautifulSoup
browser=webdriver.Chrome()
browser.get('https://www.visionias.in/resources/daily_current_affairs_programs.php?type=1&m=05&y=2024')
soup=BeautifulSoup(browser.page_source)
element = soup.find_element_by_xpath("./html/body/div[1]/div[2]/div[1]/div/div/div/div/div/a")
href = element.get_attribute('href')
print(href)
Код: Выделить всё
line 9, in
element = soup.find_element_by_xpath("./html/body/div[1]/div[2]/div[1]/div/div/div/div/div/a")
^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^
TypeError: 'NoneType' object is not callable
Код: Выделить всё
from selenium import webdriver
from bs4 import BeautifulSoup
browser=webdriver.Chrome()
browser.get('https://www.visionias.in/resources/daily_current_affairs_programs.php?type=1&m=05&y=2024')
soup=BeautifulSoup(browser.page_source)
href = soup('a')('div')[1]('div')[2]('div')[1]('div')[0]('div')[0]('div')[0]('div')[0]('div')[0][href]
#href = element.get_attribute('href')
print(href)
Код: Выделить всё
href = soup('a')('div')[1]('div')[2]('div')[1]('div')[0]('div')[0]('div')[0]('div')[0]('div')[0][href]
^^^^^^^^^^^^^^^^
TypeError: 'ResultSet' object is not callable
Кроме того, некоторые другие ссылки имеют такую же вложенность, как указано выше, есть ли способ фильтровать ссылки, используя текст внутри
Код: Выделить всё
/html/body/div[1]/div[2]/div[1]/div/div/pЯ видел другие ответы на stackoverflow, но у меня это не работает
Также, если возможно, уточните ответ, так как мне придется применить тот же код и к некоторым другим сайтам.
п>
Подробнее здесь: https://stackoverflow.com/questions/785 ... ot-working