post获取重定向的链接 python_Python爬虫后获取重定向url的两种方法

最新推荐文章于 2024-06-30 07:02:09 发布

明月贝宝哒

最新推荐文章于 2024-06-30 07:02:09 发布

阅读量344

点赞数

文章标签： post获取重定向的链接 python

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_42363231/article/details/113477808

版权

本文介绍了Python爬虫获取重定向URL的两种常见方法。第一种使用`urllib.request.urlopen().geturl()`，第二种利用`requests.get().url`。通过设置请求头，特别是User-Agent，可以更准确地获取目标页面的重定向URL，从而确保爬虫能够正确跟踪网页跳转。

摘要由CSDN通过智能技术生成

下面给大家分享Python爬虫后获取重定向url的两种方法，具体内容如下所示；

方法(一)

# 获得重定向url

from urllib import request

# https://zhidao.baidu.com/question/681501874175782812.html

url = "https://www.baidu.com/link?url=IscBx0u8h9q4Uq3ihTs_PqnoNWe7slVWAd2dowQKrnqJedvthb3zrh9JqcMJu3ZqFrbW_DKVuTnTypDbMkZx_hwCQIGFPRVWGyxRXA-65jK&wd=&eqid=f7aeecba00092ed7000000065ec62596"

print(request.urlopen(url).geturl())

方法(二)

# 请求头，这里我设置了浏览器代理

headers = headers = {'User-Agent': 'xx'}

# 这里chrome的user-agent获取方式：在浏览器地址栏输入 about://version 即可得到结果

url = "https://www.baidu.com/link?url=IscBx0u8h9q4Uq3ihTs_PqnoNWe7slVWAd2dowQKrnqJedvthb3zrh9JqcMJu3ZqFrbW_DKVuTnTypDbMkZx_hwCQIGFPRVWGyxRXA-65jK&wd=&eqid=f7aeecba00092ed7000000065ec62596"

# 请求网页

response = requests.get(url, headers=headers)

# print(response.status_code) # 打印响应的状态码

print(response.url) # 打印重定向后的网址

# 两个结果都是：https://zhidao.baidu.com/question/681501874175782812.html

到此这篇关于Python爬虫后获取重定向url的两种方法的文章就介绍到这了,更多相关python爬虫获取url内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

明月贝宝哒

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。