本文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,如有问题请及时联系我们以作处理。
PS:如有需要Python学习资料的小伙伴可以加点击下方链接自行获取
小伙伴说想听周杰伦的音乐,有什么网站是可以免费听的,然后他发现咪咕音乐可以免费听周杰伦的歌曲,既然可以免费听,那岂不是可以爬了~
-
Python 3.6
-
Pycharm
import requests
import parsel
相关模块 pip
安装即可
点击播放按钮,会自动跳转到音乐播放页面
播放界面有一个下载按钮,点击下载。
是需要登陆账号
-
打开开发者工具
-
选择network
-
点击立即下载
会有一个下载的数据接口,post请求的数据接口,里面返回的数据有携带音频真实地址。
复制url地址,是会自动下载文件到本地的
既然是post请求,只需要看data参数的变化,看它需要传递那些参数
多查看几首歌曲的下载氢气,就可以发现 copyrightId
就是每首音乐的ID值,只需要获取每首歌曲的ID值,就可以下载音乐了。
所以返回到周杰伦的音乐列表页
可以发现音乐列表页是静态网站,获取可以直接用过requests请求网站解析网站数据,可以获取音乐的ID值以及标题。
现在就是剩下最后一个问题了,那就是翻页,多页获取。
对于翻页爬取,只需要点击下一页,查看url地址的变化,找到其对应的变化规律即可。
page就是对应的页码,所以翻页爬取也搞定了,接下来就是写代码就好了
1、请求网页获取音乐的ID值以及标题
cookie 我就不带了,你可以自己登陆咪咕音乐之后复制开发者工具里面的
ef get_mp3_info(url):
headers = {
‘cookie’: ‘’,
‘user-agent’: ‘Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.138 Safari/537.36’
}
response = requests.get(url=url, headers=headers)
selector = parsel.Selector(response.text)
lis = selector.css(‘#J_PageSonglist > div.songlist-body > div’)
for li in lis:
page_url = li.css(‘.song-name-txt::attr(href)’).get()
mp3_id = page_url.split(‘/’)[-1]
title = li.css(‘.song-name-txt::attr(title)’).get()
2、post请求获取音乐下载地址
这里 headers 参数可以不用写这么多,为了方便就直接复制粘贴了,因为是post请求,有一些参数是必要带的,不然得到想要的返回结果。
def get_mp3_url(mp3_id, title):
url = ‘https://music.migu.cn/v3/api/order/download’
headers = {
‘authority’: ‘music.migu.cn’,
‘method’: ‘POST’,
‘path’: ‘/v3/api/order/download’,
‘scheme’: ‘https’,
自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。
深知大多数Python工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!
因此收集整理了一份《2024年Python开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。
既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新
如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注Python)
7b8a67243c1008edf79.png)
既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新
如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注Python)