Python爬虫爬取豆瓣高分电影附源码(详细适合新手)

一、查看网页源码


通过搜索我们可以发现网页源码中并没有我们想要抓取的内容

二、打开开发者工具(F12)

重新刷新下网页


可能有人会要问刷新完有这么多数据这怎么找,我们可以通过搜索关键词来找


获取请求地址

代码

获取数据

def url_parse():
    url="https://movie.douban.com/j/search_subjects?type=movie&tag=%E8%B1%86%E7%93%A3%E9%AB%98%E5%88%86&sort=rank&page_limit=20&page_start=0"
    headers={"User-Agent":UserAgent().random}
    response=requests.get(url=url,headers=headers).json()
    print(response)
    return response

内容解析

def content_parse(res):
    vedio_name=[]
    vedio_rate=[]
    content=res["subjects"]
    for i in content:
        name=i["title"]
        rate=i["rate"]
        vedio_name.append(name)
        vedio_rate.append(float(rate))
        print(name,rate)
    return vedio_name ,vedio_rate

制作图表

def make_pic(name,rate):
    fig=plt.figure(figsize=(15,8),dpi=80)
    font=FontProperties(fname=r"STZHONGS.TTF",size=12)
    plt.barh(name[::-1],rate[::-1],color="red")
    x_=[i*0.5 for i in range(1,21)]
    plt.xticks(x_,fontproperties=font)
    plt.yticks(name,fontproperties=font)
    plt.savefig("豆瓣.png")
    plt.show()

完整代码

import requests
from fake_useragent import UserAgent
from matplotlib import pyplot as plt
from  matplotlib.font_manager import FontProperties

#获取数据
def url_parse():
    url="https://movie.douban.com/j/search_subjects?type=movie&tag=%E8%B1%86%E7%93%A3%E9%AB%98%E5%88%86&sort=rank&page_limit=20&page_start=0"
    headers={"User-Agent":UserAgent().random}
    response=requests.get(url=url,headers=headers).json()
    #print(response)
    return response

#处理内容
def content_parse(res):
    vedio_name=[]
    vedio_rate=[]
    content=res["subjects"]
    for i in content:
        name=i["title"]
        rate=i["rate"]
        vedio_name.append(name)
        vedio_rate.append(float(rate))
        print(name,rate)
    return vedio_name ,vedio_rate

#制作图表
# def make_pic(name,rate):
#     fig=plt.figure(figsize=(15,8),dpi=80)
#     font=FontProperties(fname=r"STZHONGS.TTF",size=12)
#     plt.barh(name[::-1],rate[::-1],color="red")
#     plt.xticks(fontproperties=font)
#     plt.yticks(name,fontproperties=font)
#     plt.savefig("豆瓣.png")
#     plt.show()

#主函数
def main():
    data=url_parse()
    name,rate=content_parse(data)
    # make_pic(name,rate)

if __name__ == '__main__':
    main()
  • 19
    点赞
  • 115
    收藏
    觉得还不错? 一键收藏
  • 3
    评论
基于Python+Spark豆瓣电影爬虫和数据分析可视化系统 毕业设计-源码+全部资料+使用文档(高分优秀项目).zip 该项目是个人高分毕业设计项目源码,已获导师指导认可通过,答辩评审分达到97分,在window10/11测试环境严格调试,下载即用,确保可以运行,部署教程齐全,也可以作为课程设计 基于Python+Spark豆瓣电影爬虫和数据分析可视化系统 毕业设计-源码+全部资料+使用文档(高分优秀项目).zip 该项目是个人高分毕业设计项目源码,已获导师指导认可通过,答辩评审分达到97分,在window10/11测试环境严格调试,下载即用,确保可以运行,部署教程齐全,也可以作为课程设计 基于Python+Spark豆瓣电影爬虫和数据分析可视化系统 毕业设计-源码+全部资料+使用文档(高分优秀项目).zip 该项目是个人高分毕业设计项目源码,已获导师指导认可通过,答辩评审分达到97分,在window10/11测试环境严格调试,下载即用,确保可以运行,部署教程齐全,也可以作为课程设计 基于Python+Spark豆瓣电影爬虫和数据分析可视化系统 毕业设计-源码+全部资料+使用文档(高分优秀项目).zip 该项目是个人高分毕业设计项目源码,已获导师指导认可通过,答辩评审分达到97分,在window10/11测试环境严格调试,下载即用,确保可以运行,部署教程齐全,也可以作为课程设计 基于Python+Spark豆瓣电影爬虫和数据分析可视化系统 毕业设计-源码+全部资料+使用文档(高分优秀项目).zip 该项目是个人高分毕业设计项目源码,已获导师指导认可通过,答辩评审分达到97分,在window10/11测试环境严格调试,下载即用,确保可以运行,部署教程齐全,也可以作为课程设计

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值