Python3 scrapy 无法爬取下一页的问题

时间：2019-05-06 22:02:38 阅读：317 评论：0 收藏：0 [点我收藏+]

标签：更改方法 http tps scrapy ide ext python3 class

导致request失效的原因有两个，下面是解决方法

第一，更改代码 allowe_domains 内容

class XXSpider(scrapy.Spider):
    name = ‘xxspider‘
    allowed_domains = [‘www.xx.com‘]   #一定不要带有https://开头
    start_urls = [‘https://www.xx.com/xxxyyy/‘]

第二，更改Request函数过滤器

yield scrapy.Request(next_url, call_back=self.parse, dont_filter=True) 
#增加代码，不过滤为真

Python3 scrapy 无法爬取下一页的问题

标签：更改方法 http tps scrapy ide ext python3 class

原文地址：https://www.cnblogs.com/passagain/p/10822352.html

踩

(0)

评论一句话评论（0）