码迷,mamicode.com
首页 > 编程语言 > 详细

python3爬虫--反爬虫应对机制

时间:2018-08-07 23:57:36      阅读:235      评论:0      收藏:0      [点我收藏+]

标签:请求   开发实战   book   mil   aos   动态   blank   git   get   

python3爬虫--反爬虫应对机制

内容来源于:

Python3网络爬虫开发实战;

网络爬虫教程(python2);

 

前言:

  反爬虫更多是一种攻防战,针对网站的反爬虫处理来采取对应的应对机制,一般需要考虑以下方面:

①访问终端限制:这种可通过伪造动态的UA实现;

②访问次数限制:网站一般通过cookie/IP定位,可通过禁用cookie,或使用cookie池/IP池来反制;

③访问时间限制:延迟请求应对;

④盗链问题:通俗讲就是,某个网页的请求是有迹可循的,比如知乎的问题回答详情页,正常用户行为必然是先进入问题页,在进入回答详情页,有严格的请求顺序,如果之间跳过前面请求页面就有可能被判定为到了,通过伪造请求头可以解决这个问题;

 

内容:

cookie池的实现及使用

IP池的实现及使用

 

 

 

 

python3爬虫--反爬虫应对机制

标签:请求   开发实战   book   mil   aos   动态   blank   git   get   

原文地址:https://www.cnblogs.com/1009gavin/p/9440111.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!