python爬图代码实例_Python爬虫抓取指定网页图片代码实例

最新推荐文章于 2024-05-09 15:40:12 发布

东看西看

最新推荐文章于 2024-05-09 15:40:12 发布

阅读量933

点赞数 1

文章标签： python爬图代码实例

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_35126200/article/details/113672518

版权

想要爬取指定网页中的图片主要需要以下三个步骤：

(1)指定网站链接，抓取该网站的源代码(如果使用google浏览器就是按下鼠标右键 -> Inspect-> Elements 中的 html 内容)

(2)根据你要抓取的内容设置正则表达式以匹配要抓取的内容

(3)设置循环列表，重复抓取和保存内容

以下介绍了两种方法实现抓取指定网页中图片

(1)方法一：使用正则表达式过滤抓到的 html 内容字符串

# 第一个简单的爬取图片的程序

import urllib.request # python自带的爬操作url的库

import re # 正则表达式

# 该方法传入url,返回url的html的源代码

def getHtmlCode(url):

# 以下几行注释的代码在本程序中有加没加效果一样,但是为了隐藏自己避免被反爬虫可以假如这个伪装的头部请求

headers = {

'User-Agent': 'Mozilla/5.0(Linux; Android 6.0; Nexus 5 Build/MRA58N) \

AppleWebKit/537.36(KHTML, like Gecko) Chrome/56.0.2924.87 Mobile Safari/537.36'

}

# 将headers头部添加到url，模拟浏览器访问

url = urllib.request.Request(url, headers=headers)

# 将url页面的源代码保存成字符串

page = urllib.request.urlopen(url).read()

# 字符串转码

page

最低0.47元/天解锁文章

关注

1
点赞
踩
2

收藏

觉得还不错? 一键收藏
0
评论
python爬图代码实例_Python爬虫抓取指定网页图片代码实例

想要爬取指定网页中的图片主要需要以下三个步骤：(1)指定网站链接，抓取该网站的源代码(如果使用google浏览器就是按下鼠标右键 -> Inspect-> Elements 中的 html 内容)(2)根据你要抓取的内容设置正则表达式以匹配要抓取的内容(3)设置循环列表，重复抓取和保存内容以下介绍了两种方法实现抓取指定网页中图片(1)方法一：使用正则表达式过滤抓到的 html 内容字符...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。