您的位置:新闻资讯 >文章内容
python爬虫要如何使用代理IP
来源:http://www.ipjldl.com/News/getList/catid/17/id/707.html 作者:admin 时间:2019-06-12 16:22:35

经常碰到很多朋友问我,Python爬虫程序里应该怎样来使用代理IP,默认的urlopen是无法使用代理的IP的,今天就来分享一下python爬虫要如何使用代理IP的经验。


 python爬虫要如何使用代理IP


这里以python3为例,首先要导入 urllib的request,然后调用ProxyHandler,它可以接受代理IP的参数。

 

from urllib import request

px=request.ProxyHandler(

 

二、接着把IP地址以字典的形式放入其中,这个IP地址是我从开心代理的动态高质量代理里随便提取的一个IP。设置键为http,当然有些是https的,然后后面就是IP地址以及端口号。

st.ProxyHandler({'http':'183.188.42.148:28927'})

 

三、接着再用build_opener()来构建一个opener对象。

 

opener=request.build_opener(px)

 

四、然后调用构建好的opener对象里面的open方法来发生请求。实际上urlopen也是类似这样使用内部定义好的opener.open(),这里就相当于我们自己重写。

 

req=request.Request('网址')

res=opener.open(req)

with open('a.html','wb') as f:

f.write(res.read())

 

五、在使用代理IP的时候,可能会遇到一些错误,比如计算机积极拒绝之类的,这有可能是代理IP已经失效了,需要换个有效的代理IP来使用;也有可能遇到403或者407之类的错误,需要检查下授权对不对。总之,在使用代理IP的过程中,总会遇到一些错误,需要冷静的分析,沉着的应对,最终解决问题。


相关文章内容简介
在线客服
大客户VIP渠道
点击这里给我发消息
讨论QQ群
HTTP代理IP爬虫
客服电话
13318873961