简单几行Python代码，爬取网站图片

最新推荐文章于 2024-05-06 00:08:33 发布

小涛Dirge

最新推荐文章于 2024-05-06 00:08:33 发布

阅读量1.9k

点赞数

文章标签： python 图片爬虫

本文链接：https://blog.csdn.net/tyt_XiaoTao/article/details/80209398

版权

Python的语法很简单容易上手，适合拿来做爬虫，我做了一个简单地爬取下载网站图片
一、找到你想要爬取图片的链接地址
二、当然是编写我们的Python代码
Python版本是 3.6.2

#codeing = utf-8
#官方3.0版本已经把urllib2,urlparse等五个模块都并入了urllib中
import urllib.request
import re

def getHtml(url):
    #打开连接
    page = urllib.request.urlopen(url)
    #获取网页内容
    html = page.read()
    print(html)
    return html

def getImg(html):
    #正则表达式
    reg = r'src="(.+?\.jpg)" alt='
    imgre = re.compile(reg)
    #以列表的形式返回能匹配的子串
    imgList = re.findall(imgre,html.decode('utf-8'))
    x=0
    for imgurl in imgList:
        #把爬取到的资源保存到本地
        urllib.request.urlretrieve(imgurl,'%s.jpg' % x)
        x+=1
    return imgList
#输入你想要爬取的网站
html=getHtml("http://pic.yxdown.com/list/0_0_1.html")
print(getImg(html))

三、运行代码，就可以爬取好需要的图片了
这里写图片描述

小涛Dirge

关注

0
点赞
踩
3

收藏

觉得还不错? 一键收藏
2
评论
简单几行Python代码，爬取网站图片

Python的语法很简单容易上手，适合拿来做爬虫，我做了一个简单地爬取下载网站图片一、找到你想要爬取图片的链接地址二、当然是编写我们的Python代码 Python版本是 3.6.2#codeing = utf-8#官方3.0版本已经把urllib2,urlparse等五个模块都并入了urllib中import urllib.requestimport redef getHtml(u
复制链接

扫一扫