python利用etree实现4K图片获取

ASS-ASH

已于 2022-04-02 11:30:56 修改

阅读量7k

点赞数 14

分类专栏：数据爬取文章标签： python 人工智能开发语言后端自然语言处理

于 2022-03-28 22:57:14 首次发布

本文链接：https://blog.csdn.net/qq_38563206/article/details/123808839

版权

数据爬取专栏收录该内容

7 篇文章 4 订阅

订阅专栏

案例所用网址如下：

https://pic.netbian.com/

自动下载图片代码如下：

from lxml import etree
import requests
import os
if __name__=="__main__":
    
    url='https://pic.netbian.com/4kyouxi/'
    headers={
        'User-Agent':'Mozilla/5.0 (Macintosh; Intel Mac OS X 10.6; rv:2.0.1) Gecko/20100101 Firefox/4.0.1'
        }
    response=requests.get(url=url,headers=headers)
    response.encoding='gbk'#图片名称乱码时的处理方式
    page_text=response.text
    tree=etree.HTML(page_text)
    li_list=tree.xpath('//div[@class="slist"]/ul/li')
    if not os.path.exists('./4K游戏'):
        os.mkdir('./4K游戏')
    for li in li_list:
        img_src='http://pic.netbian.com'+li.xpath('./a/img/@src')[0]
        img_name=li.xpath('./a/img/@alt')[0]+'.jpg'
        img_data=requests.get(url=img_src,headers=headers).content
        img_path='4K游戏/'+img_name
        with open(img_path,'wb') as fp:
            fp.write(img_data)
            print(img_name,"下载成功")

下载结果显示：