python爬虫常见报错_Python爬虫总结——常见的报错、问题及解决方案

最新推荐文章于 2023-03-17 17:56:37 发布

weixin_39654245

最新推荐文章于 2023-03-17 17:56:37 发布

阅读量2.9k

点赞数 1

文章标签： python爬虫常见报错

在爬虫开发时，我们时常会遇到各种BUG各种问题，下面是我初步汇总的一些报错和解决方案。在以后的学习中，如果遇到其他问题，我也会在这里进行更新。各位如有什么补充，欢迎评论区留言~~~问题：IP被封，或者因访问频率太高被拦截？？？解决方案之一：使用代理IP即可。问题：正确使用XPath之后并没有输出？？？解决方案之一：XPath只能提取未注释的代码，改用正则表达式即可。问题：容易被反爬搞死？？？解决方...

摘要由CSDN通过智能技术生成

在爬虫开发时，我们时常会遇到各种BUG各种问题，下面是我初步汇总的一些报错和解决方案。

在以后的学习中，如果遇到其他问题，我也会在这里进行更新。

各位如有什么补充，欢迎评论区留言~~~

问题：

IP被封，或者因访问频率太高被拦截？？？

解决方案之一：

使用代理IP即可。

问题：

正确使用XPath之后并没有输出？？？

解决方案之一：

XPath只能提取未注释的代码，改用正则表达式即可。

问题：

容易被反爬搞死？？？

解决方案之一：

headers中都要带上User-Agent，而Cookie能不带则不带。

报错：

UTF-8不能处理字节？？？

解决方案之一：

在headers中加入Cookie即可输出正常的HTML。

报错：

‘ gbk ’不能处理‘ \xa0 ’ ？？？

解决方案之一：

with open(&

最低0.47元/天解锁文章

weixin_39654245

关注

1
点赞
踩
6

收藏

觉得还不错? 一键收藏
0
评论
python爬虫常见报错_Python爬虫总结——常见的报错、问题及解决方案

在爬虫开发时，我们时常会遇到各种BUG各种问题，下面是我初步汇总的一些报错和解决方案。在以后的学习中，如果遇到其他问题，我也会在这里进行更新。各位如有什么补充，欢迎评论区留言~~~问题：IP被封，或者因访问频率太高被拦截？？？解决方案之一：使用代理IP即可。问题：正确使用XPath之后并没有输出？？？解决方案之一：XPath只能提取未注释的代码，改用正则表达式即可。问题：容易被反爬搞死？？？解决方...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。