qq:800819103
在线客服,实时响应
qq群
在线客服,实时响应
客服电话
133188739611. 设置背景
在使用selenium浏览器渲染技术,当我们爬取某个网站的信息的时候,在一般情况下速度都不是特别的快。而且需要利用selenium浏览器渲染技术爬取的网站,反爬虫的应对技术都比较厉害,对IP访问频率有很高程度的限制。所以,如果想提升selenium抓取数据的速度,可以从两个方面出发:
第一方面, 抓取频率要提高,破解出现的验证信息,一般都是验证码或者是用户登陆 。
第二方面,使用多线程 + 代理IP, 这种方式,需要电脑有足够的内存和充足稳定的代理IP 。
2. 为chrome设置代理IP
注意事项:
第一,选择稳定的固定的代理IP。不要选择动态代理IP。我们常用的爬虫IP代理通常都是具有高度保密性质的高匿名动态IP,是通过拨号动态产生的,时效性非常的短,一般都是在3分钟左右。对于scrapy这种并发度很高,又不需要登录的爬虫来说,非常合适,但是在浏览器渲染类爬虫中并不适用。
第二,选择速度较快的代理IP。因为selenium爬虫采用的是浏览器渲染技术,这种浏览器渲染技术速度就本身就很慢。如果选择的代理IP速度较慢,爬取的时间就会进一步增加。
第三,要有足够大的电脑内存。因为chrome占内存较大,在并发度很高的情况下,容易造成浏览器崩溃,也就是程序崩溃。
第四,在程序结束时,调用 browser.quit( ) 清除浏览器缓存。
3. 需要用户名密码验证的代理
相关文章内容简介
1 selenium+python设置爬虫代理IP的方法
selenium+python设置爬虫代理IP的方法 ∵ ∵ ∵ 1.∵设置背景 在使用selenium浏览器渲染技术,当我们爬取某个网站的信息的时候,在一般情况下速度都不是特别的快。而且需要利用selenium浏览器渲染技术爬取的网站,反爬虫的应对技术都比较厉害,对IP访问频率有很高程度的限制。所以,如果想提升selenium抓取数据的速度,可以从两个方面出发: 第一方... [阅读全文]
最新标签
推荐阅读
06
2018-12
高匿代理是更加安全吗?如何更好的保护隐私
信息时代,大家对于信息安全即使有保护意识,但是还是不可避免的被各种企业泄露出去,那么如何保护隐私呢?使用高匿代理是更加安全吗?高匿代理能保护什么隐私呢?
25
2019-07
ADSL拨号与代理IP的不同
ADSL拨号和代理IP都能帮助我们换IP,就有很多人疑惑既然ADSL拨号可以拨号为什么还要用代理IP。那么,ADSL拨号与代理IP的不同呢?
11
2019-05
ip代理软件排行榜
现在市面上的ip代理软件太多了,但是多属于万人骑IP资源,这种IP做业务是很容易被封禁的。那么ip代理软件排行榜,针对网页代理第一名的黑洞HTTP适用范围及特点:
17
2019-04
一步步编写自己的PHP爬取代理IP项目
第一章节主要给大家普及一下爬虫的概念以及相关的知识,让大家对后面的学习打下扎实的基础。如果你是有经验的开发者,完全可以跳过第一章进入第二章的学习了。
热门文章