图片爬取和思路分析

//我先准备一个记事本准备页面网址

s=页数

q=搜索值

//爬取相对的网页数据

//找到图片的网址在源代码中ctrl+f 找到TB1xjf5dFhM8kjiszfwxxcib的代码复制用正则精准爬取

//遍历结果

import urllib.request
import re
suo="夹克男"
key=urllib.request.quote(suo)
for i in range(0,1):
url="http://s.taobao.com/list?spm=a21bo.2017.201867-links-0.5.5af911d9M4bXRK&q="+str(key)+"&cat=16&style=grid&seller_type=taobao&bcoffset=12&s="+str(i*60)
jie=urllib.request.urlopen(url).read().decode("utf-8","ignore")
string='"pic_url":"//(.*?)"'
go=re.compile(string).findall(str(jie))
for j in range(len(go)):
temg=go[i]
temg1="http://"+temg
dom="D:/image/"+str(i)+str(j)+".jpg"
urllib.request.urlretrieve(temg1,filename=dom)

转载于:https://www.cnblogs.com/chunqing/p/9067183.html

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值