Я нахожусь на начальной стадии кодирования... Пытаюсь вытащить из Википедии текст из ссылок на песни из div, используя теги "a". Однако я могу получить только первую песню для каждой буквы алфавита. Я удаляю текст вместо заголовка, так как у некоторых ссылок отсутствует заголовок в html. Если кто-то может помочь, спасибо!
import requests
from bs4 import BeautifulSoup
import pandas as pd
url = 'https://en.wikipedia.org/wiki/Category: ... ohn_Lennon'
data = requests.get(url)
soup = BeautifulSoup(data.content, "html.parser")
div = soup.find"div", {"class":"mw-category mw-category-columns"})
songs = []
for song in div:
songs.append(song.find_next("a").text.strip())
print(songs)
Выход:
['Air Talk', "Baby's Heartbeat", 'Cambridge 1969', 'Dear John (John Lennon song)',
'Every Man Has a Woman Who Loves Him', 'F Is Not a Dirty Word', 'Gimme Some Truth',
'Happy Xmas (War Is Over)', "I Don't Wanna Be a Soldier", 'Jamrag (song)',
'Kiss Kiss Kiss (Yoko Ono song)', 'Listen, the Snow Is Falling', 'Many Rivers to Cross',
'New York City (John Lennon and Yoko Ono song)', "O'Wind (Body Is the Scar of Your Mind)",
'Paper Shoes', 'Radio Play (song)', 'Scared (John Lennon song)', 'Telephone Piece',
'Waiting for the Sunrise (song)', 'Yang Yang (song)']
Подробнее здесь: https://stackoverflow.com/questions/781 ... ifulsoup-u