HTTP代理协议的分析和原理

HTTP协议简介
HTTP协议是一个专门传送数据的一种协议。可以通过HTTP协议获取一些相关数据。
1 HTTP工作性质
可以通过HTTP协议向互联网网站发出相关请求获取相应数据。
Web服务器分为:Apache服务器,IIS服务器等。
Web服务器根收到HTTP请求后,向客户端发送响应信息。
HTTP一般默认端口80,当然也支持其他更多不一样的端口
2 HTTP常见状态码
使用亿牛云爬虫代理经常出现的HTTP状态码:
http状态码407
原因:代理认证信息失败,让对方严格按照demo配置代理信息
http状态码429
原因:请求超过代理限制,严格按照所开代理的请求数,按照300毫秒为单位进行管理。如果限制之后,既然大量429,需要优化爬虫策略,应该是目标网站返回的错误提示。
http状态码302
原因:访问的是https网站,会自动跳转一次,正常现象;访问的http网站,网站拒绝服务,大量302需要优化爬虫策略
http状态码403 503 或504
原因:少量不影响,大量403 503或504需要优化爬虫策略
还有一些其他的状态码建议以网上的介绍为准。
3 python爬虫如何请求HTTP代理协议
#! -- encoding:utf-8 --
import aiohttp, asyncio
targetUrl = “http://httpbin.org/ip”
# 代理服务器(产品官网 www.16yun.cn)
proxyHost = “t.16yun.cn”
proxyPort = “31111”
# 代理验证信息

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值