https://www.oddsportal.com/inplay-odds/ ... /football/
на основе это полезное руководство https://github.com/jckkrr/Unlayering_Oddsportal,
Моя цель — получить данные о коэффициентах в реальном времени для каждой игры, но я столкнулся с проблемой доступа к необходимым URL-адресам. .
Используя библиотеку запросов Python, я могу получить список всех текущих матчей по URL-адресу канала:
https://www.oddsportal.com/feed/livegames/liveOdds /0/0.dat?_=
Код: Выделить всё
import requests
url = "https://www.oddsportal.com/feed/livegames/liveOdds/0/0.dat?_="
response = requests.get(url)
data = response.text
Коэффициенты содержатся в отдельных URL-адресах со следующей структурой:
Код: Выделить всё
https://fb.oddsportal.com/feed/match/1-1-{match_id_code}-1-2-{secondary_id_code}.dat[img]https:// i.stack.imgur.com/CDHbi.png[/img]
В этом примере (на скриншоте) первый идентификационный код AsILkjnd можно найти в списке все прямые матчи из этого URL-адреса канала: https://www.oddsportal.com/feed/livegam ... 0/0.dat?_=
но дополнительный_id_код там не найден или даже в HTML-коде отдельной страницы.
В настоящее время я застрял в поиске и декодировании вторичного_id_кода.
Похоже, это URL-адрес закодированная строка, похожая на %79%6a%39%64%39, которая, как я полагаю, скрыта в коде HTML или JavaScript веб-сайта.
До сих пор я не удалось найти эти закодированные строки.
Кто-нибудь может помочь, как найти и расшифровать эти закодированные URL-строки
Подробнее здесь: https://stackoverflow.com/questions/781 ... t-for-scra