Python采集ip代理,并检测是否可用(仅用于学习交流)(2)

本文介绍了在编写爬虫时使用IP代理的基本思路,包括数据来源分析、发送请求、获取并解析服务器响应、以及使用requests、re和parsel等模块进行代码实现。还提到了如何检测IP代理的可用性。
摘要由CSDN通过智能技术生成
  • 为什么使用ip代理

  • 基本思路

  • 代码展示

  • 视频展示

为什么使用ip代理

===================================================================

我们写爬虫程序,爬多了或者请求爬取数据快了,服务器就会拒绝访问,同时一个IP多次快速请求,网站会把你IP封掉,这时候 要么等一段时间,要么换IP。

基本思路

==============================================================

1.数据来源分析

找我们想要数据内容, 从哪里来的

2.发送请求

对于目标网址发送请求 https://www.kuaidaili.com/free/

3.获取数据

获取服务器返回响应数据(网页源代码)

4.解析数据

提取我们想要的数据内容

5.保存数据

爬音乐 视频 本地csv 数据库… IP检测, 检测IP代理是否可用 可用用IP代理 保存

代码展示

==============================================================

模块拓展

requests 是数据请求模块,属于第三方模块,安装方法 pip install requests

re 是正则表达式模块,属于内置模块,不需要安装;

parsel 是数据解析模块,属于第三方模块,这个是scrapy框架核心组件,安装方法 pip install parsel

from 从

import 导入

从 什么模块里面 导入 什么方法

from xxx import * 导入所有方法

全部代码

import requests

import re

import parsel

flis = []

lis_1 = []

for page in range(11, 21):

url = f’https://www.kuaidaili.com/free/inha/{page}/’ # 确定请求url地址

用requests模块里面get 方法 对于url地址发送请求, 最后用response变量接收返回数据

response = requests.get(url)

xpath 提取数据

selector = parsel.Selector(response.text) # 把html 字符串数据转成 selector 对象

ip_list = selector.xpath(‘//*[@id=“list”]/table/tbody/tr/td[1]/text()’).getall()

自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。

深知大多数Python工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!

因此收集整理了一份《2024年Python开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。

img

img

img

img

img

img

既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!

由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新

如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)

的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!**

由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新

如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)

  • 6
    点赞
  • 18
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值