Подобные вопросы задавались и раньше, но я учел эти рекомендации и провел дополнительный анализ, поэтому надеюсь, что кто-нибудь из сообщества Python сможет помочь, поскольку эта проблема остается нерешенной.
Это работает:
Код: Выделить всё
curl -v --http1.1 -H "User-Agent: Mozilla/5.0 (Macintosh; Intel Mac OS X 10.15; rv:127.0) Gecko/20100101 Firefox/127.0" https://www.kron4.com/
> GET / HTTP/1.1
> Host: www.kron4.com
> Accept: */*
> User-Agent: Mozilla/5.0 (Macintosh; Intel Mac OS X 10.15; rv:127.0) Gecko/20100101 Firefox/127.0
Код: Выделить всё
curl -v -H "User-Agent: Mozilla/5.0 (Macintosh; Intel Mac OS X 10.15; rv:127.0) Gecko/20100101 Firefox/127.0" https://www.kron4.com/
> GET / HTTP/2
> Host: www.kron4.com
> Accept: */*
> User-Agent: Mozilla/5.0 (Macintosh; Intel Mac OS X 10.15; rv:127.0) Gecko/20100101 Firefox/127.0
Код: Выделить всё
import requests
headers = {'User-Agent': 'Mozilla/5.0 (Macintosh; Intel Mac OS X 10.15; rv:127.0) Gecko/20100101 Firefox/127.0'}
response = requests.get(url, headers=headers)
response.raise_for_status()
>File "/Users/xxxxx/Documents/workspace/NewsFu/myenv/lib/python3.11/site-packages/requests/models.py", line 1024, in raise_for_status
raise HTTPError(http_error_msg, response=self)
requests.exceptions.HTTPError: 403 Client Error: Forbidden for url: https://www.kron4.com/
Подробнее здесь: https://stackoverflow.com/questions/787 ... is-website