第一个小爬虫--爬取图片并保存

最新推荐文章于 2023-04-21 11:30:33 发布

蜕_变

最新推荐文章于 2023-04-21 11:30:33 发布

阅读量2k

点赞数

分类专栏：初识python 文章标签：爬虫 url 爬取图片初学者

本文链接：https://blog.csdn.net/william_sunrise/article/details/78857883

版权

初识python 专栏收录该内容

10 篇文章 0 订阅

订阅专栏

import urllib.request
import re
import os

def url_open(url):
    req=urllib.request.Request(url)
    req.add_header('User-Agent','Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.113 Safari/537.36')
    response=urllib.request.urlopen(url)
    html=response.read().decode('utf-8')
    return html

def get_img(html):
    p=r'<img src="([^"]+\.jpg)"'
    imglist=re.findall(p,html)
    '''
    for each in imglist:
        print (each)
    '''
    for each in imglist:
        filename=each.split("/")[-1]
        urllib.request.urlretrieve(each,filename,None)

if __name__=='__main__':
    os.mkdir("E:\Pict")
    os.chdir("E:\Pict")
    url='https://www.zhihu.com/question/40007169'
    get_img(url_open(url))

优惠劵

蜕_变

关注关注

0
点赞
踩
5

收藏

觉得还不错? 一键收藏
1
评论
第一个小爬虫--爬取图片并保存

import urllib.requestimport reimport osdef url_open(url): req=urllib.request.Request(url) req.add_header('User-Agent','Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like
复制链接

扫一扫