python爬虫异常处理_python 爬虫3 异常处理

最新推荐文章于 2023-05-20 21:02:37 发布

小茹学姐

最新推荐文章于 2023-05-20 21:02:37 发布

阅读量275

点赞数

文章标签： python爬虫异常处理

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_34544309/article/details/113984608

版权

importurllib2

requset= urllib2.Request('http://www.xxxxx.com')try:

urllib2.urlopen(requset)excepturllib2.URLError, e:print e.reason

2.HTTPError

HTTPError是URLError的子类，在你利用urlopen方法发出一个请求时，服务器上都会对应一个应答对象response，其中它包含一个数字”状态码”。举个例子，假如response是一个”重定向”，需定位到别的地址获取文档，urllib2将对此进行处理。

其他不能处理的，urlopen会产生一个HTTPError，对应相应的状态吗，HTTP状态码表示HTTP协议所返回的响应的状态。下面将状态码归结如下：

200：请求成功处理方式：获得响应的内容，进行处理

202：请求被接受，但处理尚未完成处理方式：阻塞等待

204：服务器端已经实现了请求，但是没有返回新的信息。如果客户是用户代理，则无须为此更新自身的文档视图。处理方式：丢弃

300：该状态码不被HTTP/1.0的应用程序直接使用，只是作为3XX类型回应的默认解释。存在多个可用的被请求资源。处理方式：若程序中能够处理，则进行进一步处理，如果程序中不能处理，则丢弃

301：请求到的资源都会分配一个永久的URL，这样就可以在将来通过该URL来访问此资源处理方式：重定向到分配的URL

302：请求到的资源在一个不同的URL处临时保存处理方式：重定向到临时的URL

304：请求的资源未更新处理方式：丢弃

400：非法请求处理方式：丢弃

401：未授权处理方式：丢弃

403：禁止处理方式：丢弃

404：没有找到处理方式：丢弃

500：服务器内部错误服务器遇到了一个未曾预料的状况，导致了它无法完成对请求的处理。一般来说，这个问题都会在服务器端的源代码出现错误时出现。

501：服务器无法识别服务器不支持当前请求所需要的某个功能。当服务器无法识别请求的方法，并且无法支持其对任何资源的请求。

502：错误网关作为网关或者代理工作的服务器尝试执行请求时，从上游服务器接收到无效的响应。

503：服务出错由于临时的服务器维护或者过载，服务器当前无法处理请求。这个状况是临时的，并且将在一段时间以后恢复。

因为urllib2可以为你处理重定向，也就是3开头的代号可以被处理，并且100-299范围的号码指示成功，所以你只能看到400-599的错误号码。

下面我们写一个例子来感受一下，捕获的异常是HTTPError，它会带有一个code属性，就是错误代号，另外我们又打印了reason属性，这是它的父类URLError的属性。

importurllib2

req= urllib2.Request('http://blog.csdn.net/cqcre')try:

urllib2.urlopen(req)excepturllib2.HTTPError, e:printe.codeprint e.reason

进一步加入

1.HTTPError的父类是URLError

2.hasattr属性提前对属性进行判断

importurllib2

req= urllib2.Request('http://blog.csdn.net/cqcre')try:

urllib2.urlopen(req)excepturllib2.URLError, e:if hasattr(e,"code"):printe.codeif hasattr(e,"reason"):printe.reasonelse:print "OK"

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
python爬虫异常处理_python 爬虫3 异常处理

importurllib2requset= urllib2.Request('http://www.xxxxx.com')try:urllib2.urlopen(requset)excepturllib2.URLError, e:print e.reason2.HTTPErrorHTTPError是URLError的子类，在你利用urlopen方法发出一个请求时，服务器上都会对应一个应答对象res...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。