码迷,mamicode.com
首页 > Web开发 > 详细

webmagic使用手册

时间:2017-12-26 00:53:57      阅读:238      评论:0      收藏:0      [点我收藏+]

标签:selenium   具体步骤   javascrip   http   ade   pos   作者   blog   下载   

https://my.oschina.net/flashsword/blog/180623

重点

SeleniumDownloader

对于一些Javascript动态加载的网页,仅仅使用http模拟下载工具,并不能取到页面的内容。这方面的思路有两种:一种是抽丝剥茧,分析js的逻辑,再用爬虫去重现它;另一种就是:内置一个浏览器,直接获取最后加载完的页面。webmagic-selenium包中整合了Selenium到SeleniumDownloader,可以直接进行动态加载页面的抓取。使用selenium需要安装一些native的工具,具体步骤可以参考作者的博文使用Selenium来抓取动态加载的页面

webmagic使用手册

标签:selenium   具体步骤   javascrip   http   ade   pos   作者   blog   下载   

原文地址:https://www.cnblogs.com/zongyl/p/8111550.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!