码迷,mamicode.com
首页 > 编程语言 > 详细

Python3 scrapy 无法爬取下一页的问题

时间:2019-05-06 22:02:38      阅读:317      评论:0      收藏:0      [点我收藏+]

标签:更改   方法   http   tps   scrapy   ide   ext   python3   class   

导致request失效的原因有两个,下面是解决方法

第一,更改代码 allowe_domains 内容

class XXSpider(scrapy.Spider):
    name = ‘xxspider‘
    allowed_domains = [‘www.xx.com‘]   #一定不要带有https://开头
    start_urls = [‘https://www.xx.com/xxxyyy/‘]

  

第二,更改Request函数过滤器

yield scrapy.Request(next_url, call_back=self.parse, dont_filter=True) 
#增加代码,不过滤为真

  

Python3 scrapy 无法爬取下一页的问题

标签:更改   方法   http   tps   scrapy   ide   ext   python3   class   

原文地址:https://www.cnblogs.com/passagain/p/10822352.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!