Python爬取图片到本地

最新推荐文章于 2024-08-14 17:18:35 发布

高冷的恒哥

最新推荐文章于 2024-08-14 17:18:35 发布

阅读量238

点赞数 1

文章标签： python 开发语言

本文链接：https://blog.csdn.net/zhaoheng2017/article/details/136128097

版权

网上的图片一般都是按照顺序来排列的，所以可以使用for循环来逐步爬取，示例代码如下：

import requests
# 定义请求的前缀，方便使用for循环
url_prefix = ""

payload = {}
headers = {
  'authority': 'static17.hentai-img.com',
  'accept': 'text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.7',
  'accept-language': 'zh-CN,zh;q=0.9',
  'cache-control': 'no-cache',
  'cookie': '_ga=GA1.1.572401129.1708015512; _ga_1PLLYQLZ1L=GS1.1.1708055164.3.1.1708055166.58.0.0',
  'pragma': 'no-cache',
  'sec-ch-ua': '"Not A(Brand";v="99", "Google Chrome";v="121", "Chromium";v="121"',
  'sec-ch-ua-mobile': '?0',
  'sec-ch-ua-platform': '"Windows"',
  'sec-fetch-dest': 'document',
  'sec-fetch-mode': 'navigate',
  'sec-fetch-site': 'none',
  'sec-fetch-user': '?1',
  'upgrade-insecure-requests': '1',
  'user-agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/121.0.0.0 Safari/537.36'
}

for i in range(100,241):
    url =  url_prefix + str(i) + ".jpg"
    response = requests.request("GET", url, headers=headers, data=payload)
    print("请求图片地址：" + url)
    if response.status_code == 200:
        a = ""
        if(i<10):
            a = "00" + str(i)
        elif(i<100):
            a = "0" + str(i)
        else:
            a = str(i)
        with open ("D:\\temp\\url3\\" + a + ".jpg", 'wb') as f:
            f.write(response.content)
        print("第"+ str(i) +"张图片保存成功")
    else:
        print("第"+ str(i) +"张图片保存失败")