Python爬虫, 哪些奇特的网站值得一爬! 谱时网爬虫实例

本文介绍了如何使用Python爬虫抓取谱时网热门图片直播页面的所有图片信息,分析了页面动态加载的机制,并提供了简单的代码实现。适合Python爬虫初学者学习。
摘要由CSDN通过智能技术生成

在我们学习的过程中,打开一个网站就想抓一次数据,但是并不是所有的网站都可以用一种方式抓到数据的,有的是网页结构特殊,有的是json数据包不一样,慢慢的写一些自己在抓站过程中遇到的奇特的网站,分享思路和抓取方法给大家!

工具、目标

工具:pycharm、python3.6版本

库:requests库

目标:谱时网热门图片直播页面,所有的图片信息

说明:该网站有热门图片页面,里面有活动的相关照片,按活动将所有的图片信息写入txt文档(不下载图片,是为了不对服务器造成影响)!

目标分析

image

首先,如上图打开主页,其它的不用管,直接点击右上角,出现选项后,点击进入热门图片直播选项(注意:有的浏览器要缩放页面,才可以看到热门图片直播的选项),进入后页面如下所示

image

这里我是缩放到了30%,下方呢,就是一个个的活动图片直播的页面了。随便点开一个活动,我们看看页面

image

<
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值