python3下载url图片假死_python3 网页爬虫图片下载无效链接处理 try except

代码比较粗糙,主要是备忘容易出错的地方。供自己以后查阅。

#图片下载

import re

import urllib.request    #python3中模块名和2.x(urllib)的不一样

site='https://world.taobao.com/item/530762904536.htm?spm=a21bp.7806943.topsale_XX.4.jcjxZC'

page=urllib.request.urlopen(site)

html=page.read()

html=html.decode('utf-8')    #读取下来的网页源码需要转换成utf-8格式

reg=r'src="//(gd.*?jpg)'

imgre=re.compile(reg)

imglist=re.findall(imgre,html)

trueurls=[]

for i in imglist:

trueurls.append(i.replace('gd','http://gd'))

trueurls[2]='http://wlgsad.com.jpg'

print (trueurls)

x=200

for j in trueurls:

try:

urllib.request.urlretrieve(j,'%s.jpg' %x)

except Exception :     #except Exception as e:

pass        #    print (e)

#     print ('有无效链接')

x=x+1

在except子句可以打印出一些提示信息

下载图片的时候,如果有无效的链接,可以用try except跳过无效链接继续下一个图片的下载

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值