python利用selenium爬取图片信息

python利用selenium爬取图片信息

项目目标:通过运用python爬虫技术,模仿人为操作,克服反爬机制,爬取想要得到的信息

项目流程图
在这里插入图片描述
taob_view.py

from selenium.webdriver import Chrome       #引入selenium中的Chrome
from selenium.webdriver.common.keys import Keys       #引入键盘
import time         #时间模块
import requests

browser=Chrome()         #创建浏览器
browser.get("http://www.taobao.com")
#找到输入框,输入男装并且回车
browser.find_element_by_xpath('//*[@id="q"]').send_keys("男装",Keys.ENTER)

#让程序等待,用户手动登录
while browser.current_url.startswith("https://login.taobao.com"):
	print("等着")
	time.sleep(1)

n=1
#找到页面的所有item
while 1:
	items=browser.find_element_by_class_name("m-itemlist").find_elements_by_class_name("item")
	for item in items:
		src_path=item.find_element_by_class_name("pic-box").find_element_by_tag_name("img").get_attribute("data-src")
		src_path="http:"+src_path
		#下载这张图片,保存在文件中
		open(f"{n}.jpg",mode="wb").write(requests.get(src_path).content)
		n+=1

	browser.find_element_by_class_name("m-page").find_element_by_class_name("next").click()
	time.sleep(2)
	print("下一页了")


  • 2
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 4
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 4
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值