导致request失效的原因有两个,下面是解决方法
第一,更改代码 allowe_domains 内容
class XXSpider(scrapy.Spider):
name = 'xxspider'
allowed_domains = ['www.xx'] #一定不要带有https://开头
start_urls = ['https://www.xx/xxxyyy/']
第二,更改Request函数过滤器
yield scrapy.Request(next_url, call_back=self.parse, dont_filter=True)
#增加代码,不过滤为真
转载于:https://wwwblogs/passagain/p/10822352.html
更多推荐
Python3 scrapy 无法爬取下一页的问题
发布评论