自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(4)
  • 收藏
  • 关注

原创 python中selenium使用入门1

本次为使用自动化测试工具selenium模拟人操作来对数据进行爬取,当然selenium使用方法很多,今天暂时先通过模拟账号登录来初步认识selenium的基础使用

2023-03-16 11:05:07 123

原创 python使用进程池(线程池)对网页数据进行抓取

为使用xpath对静态网页数据进行抓取并使用MongoDB对数据进行保存,同时使用进程池(线程池)提高抓取速度

2023-03-13 12:02:05 323

原创 02.python使用正则表达式对身份证进行识别

本次为刚刚学习正则表达式,主要使用re.match与re.findall及匹配字符通过验证输入身份证号格式、出生年月日格式、校验码及地址码判断输入身份证号是否正确,并输出身份证号、户籍所在地(网上找的对应表不知道是否正确)、出生年月日及性别信息,只是很初级的一个判断方法,代码如下(其中包含一个地址码对应户籍所在地的字典有点大)

2023-02-27 18:42:06 2317

原创 python爬虫使用xpath及bs4解析数据

python爬虫使用xpath及bs4解析数据

2023-02-24 17:44:50 469 1

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除