Python爬虫：requests模块深入及案例

最新推荐文章于 2024-07-18 15:53:23 发布

高工程序猿

最新推荐文章于 2024-07-18 15:53:23 发布

阅读量1k

点赞数 23

分类专栏：程序员学习文章标签： python 爬虫 java

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_60721695/article/details/136860740

版权

程序员学习专栏收录该内容

8 篇文章 0 订阅

订阅专栏

本文介绍了如何使用Python的requests库处理URL携带的参数，包括GET和POST请求，以及如何将参数转换为字典并封装至请求中。还展示了如何通过requests库调用百度翻译和获取豆瓣电影评分前几名的信息，涉及JSON格式数据处理和文件存储。

摘要由CSDN通过智能技术生成

处理url携带的参数：封装到字典中

keyWord = input(‘CSDN Search KeyWord is :’)

param = {

请求所需的参数，字典类型

‘q’:keyWord

}

response = requests.get(url=searchURL ,params=param)

指定url发起请求是携带参数的，请求时将params中的字典类型数据转换为url中参数

pageText = response.text

爬取到的文本数据

fileName = keyWord + ‘.html’

with open(‘./dataFiles/’+fileName,‘w’,encoding=‘utf-8’) as fp:

fp.write(pageText)

生成以关键字命名的html文件

在这里插入图片描述

案例二：输入单词获取百度翻译的结果

在这里插入图片描述

检查网页可知，百度翻译的请求方式为post，需要用到requests.post()。关键字为data里面的kw。

requests.post(url= ,data= ,headers= )

url：请求页面
data：关键字，字典类型
headers：头信息，字典类型，用于UA伪装

百度翻译

- post请求

- 响应数据是JSON格式

import requests

import json

postURL = ‘https://fanyi.baidu.com/sug’

UA伪装

postHeader = {

‘User-Agent’: ‘来自网页检查’

}

参数处理

data = {

‘kw’: ‘baby’

post请求的参数数据与get一致，与get方法不同的是不显示在地址栏，可以通过检查查看

kw为网址指定的参数名，若修改则发生未知错误

}

发送请求

response = requests.post(url=postURL, data=data, headers=postHeader)

获取响应数据，json格式

dataObj = response.json()

print(dataObj)

存储

jsonFilePath = open(‘./dataFiles/dog.json’, ‘w’, encoding=‘utf-8’)

json.dump(dataObj, fp=jsonFilePath, ensure_ascii=False)

print(‘Over!’)

在这里插入图片描述

案例三：获取豆瓣电影的评分前几名的电影信息

方法与上面两个案例类似，直接看代码

获取豆瓣电影排行榜信息

import requests

import json

doubanURL = ‘https://movie.douban.com/j/chart/top_list?’

url地址

doubanParam = {

#参数

‘type_name’:‘喜剧’,

‘type’: 24,

‘interval_id’: ‘100:90’,

（1）Python所有方向的学习路线（新版）

这是我花了几天的时间去把Python所有方向的技术点做的整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照上面的知识点去找对应的学习资源，保证自己学得较为全面。

最近我才对这些路线做了一下新的更新，知识体系更全面了。

在这里插入图片描述

（2）Python学习视频

包含了Python入门、爬虫、数据分析和web开发的学习视频，总共100多个，虽然没有那么全面，但是对于入门来说是没问题的，学完这些之后，你可以按照我上面的学习路线去网上找其他的知识资源进行进阶。

在这里插入图片描述

（3）100多个练手项目

我们在看视频学习的时候，不能光动眼动脑不动手，比较科学的学习方法是在理解之后运用它们，这时候练手项目就很适合了，只是里面的项目比较多，水平也是参差不齐，大家可以挑自己能做的项目去练练。

在这里插入图片描述

小编13年上海交大毕业，曾经在小公司待过，也去过华为、OPPO等大厂，18年进入阿里一直到现在。

深知大多数初中级Python工程师，想要提升技能，往往是自己摸索成长或者是报班学习，但自己不成体系的自学效果低效又漫长，而且极易碰到天花板技术停滞不前！

因此收集整理了一份《2024年Python爬虫全套学习资料》送给大家，初衷也很简单，就是希望能够帮助到想自学提升又不知道该从何学起的朋友，同时减轻大家的负担。

由于文件比较大，这里只是将部分目录截图出来，每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频

如果你觉得这些内容对你有帮助，可以添加下面V无偿领取！（备注：python）

024年Python爬虫全套学习资料》送给大家，初衷也很简单，就是希望能够帮助到想自学提升又不知道该从何学起的朋友，同时减轻大家的负担。**

由于文件比较大，这里只是将部分目录截图出来，每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频

如果你觉得这些内容对你有帮助，可以添加下面V无偿领取！（备注：python）
[外链图片转存中…(img-puOGu4G4-1710878525752)]

高工程序猿

关注

23
点赞
踩
20

收藏

觉得还不错? 一键收藏
0
评论
Python爬虫：requests模块深入及案例

param = {
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。