Я работал над трехуровневым сканированием глубины, где мне нужно исключить некоторые классы CSS, такие как верхний и нижний колонтитулы. Я пробовал использовать атрибут "restrict_css" с :not("#header"), но он не работает и
Я не совсем уверен, как лучше всего извлечь все ссылки с помощью LinkExtractor.
Я пробовал:
LinkExtractor(restrict_css= ":not(#header)")
Подробнее здесь: https://stackoverflow.com/questions/784 ... tor-scrapy