python实例2-写一个爬虫下载小功能

沐阳zz

于 2017-01-02 10:17:38 发布

阅读量1.3k

点赞数

分类专栏： pthon学习

本文链接：https://blog.csdn.net/qq_33932782/article/details/53976094

版权

pthon学习专栏收录该内容

25 篇文章 0 订阅

订阅专栏

主要是通过url，和re两个模块对一个网页的固定图片进行模糊匹配后下载下来。

#! /usr/bin/python
import re
import urllib

def gethtml(url):
    page = urllib.urlopen(url)
    html = page.read()
    return html

def getimg(html):
    reg = r'src="(.*?\.jpg)" width'
    imgre = re.compile(reg)
    imglist = re.findall(imgre,html)
    x = 0
    for imgurl in imglist:
        urllib.urlretrieve(imgurl,'%s.jpg' % x)
        x+=1

html = gethtml("http://www.zhuoku.com/")
print getimg(html)
~

代码比较简单，定义了两个模块，使用url获取到网页信息，使用re模块匹配到jpg的文件，最后下载下来。