Почему pandas read_html автоматически удаляет десятичный разделитель?Python

Программы на Python
Anonymous
Почему pandas read_html автоматически удаляет десятичный разделитель?

Сообщение Anonymous »

Я пытался получить таблицу с веб-сайта, но по какой-то причине pandas автоматически превращает каждый столбец в строку, и поэтому некоторые значения становятся совершенно бесполезными.
Например, 0,62 становится 062. Я уже давно пытаюсь это исправить, но ничего не могу найти в сети. ChatGPT тоже бесполезен.
Я относительно новичок в программировании и впервые использую Pandas, поэтому заранее прошу прощения, если допустил какие-то глупые ошибки.
Это небольшой блок кода. Я в основном использую selenium вместе с beautifulsoup, чтобы идентифицировать нужный источник, а затем считываю его с помощью read_html().

Код: Выделить всё

table = soup.find("table", attrs={"id": "stats_shooting"})
df = pd.read_html(str(table))[0]
Вот URL-адрес, который я пытался очистить, если он кому-то понадобится:
https://fbref.com/it/comp/ 11/shooting/Statistiche-di-Serie-A#all_stats_shooting
Его столбцы многоиндексные, но я уже разобрался с этой проблемой.

Подробнее здесь: https://stackoverflow.com/questions/783 ... -separator

Вернуться в «Python»