用python重新定义【2024十大网络流行语】(1)

dic[‘tittle’] = doc(‘#doctitle’).text()

dic[‘num’] = doc(‘#doc-aside > div.columns.ctxx > ul > li:nth-child(1)’).text()

data.append(dic)

time.sleep(random.random())

n = n + 1

return data

爬取成功√

共929个词语。

我们在获取这些热门流行词的同时,也获取了他们的一些其他数据,比如浏览次数和出现时间。

在这里插入图片描述

但浏览次数很难作为评判这个词语是否热门的指标,毕竟大家又不是都来这个网站搜索,所以还是需要一个全网的数据才更准确一点。

一开始选择了百度指数,结果发现很多词语没有收录,需要付费。于是我就选用了搜狗指数!

在这里插入图片描述

将刚才爬取得到的929个网络流行语,可以根据下面式子来构造url。

urls= ‘http://zhishu.sogou.com/index/searchHeat?kwdNamesStr=’+str(name)+‘&timePeriodType=YEAR&dataType=SEARCH_ALL’

再循环爬取依次得到他们的年度平均搜索指数。

成功得到2019年度网络热门流行词排行榜(凹凸玩数据版)!

在这里插入图片描述

其中标记绿色的词语为2018年末出现,在2019年开始流行,在统计时也列入列入2019流行语中。

2019网络热门流行词排行榜


根据上文得到的热门流行词排行榜,小五又搜集了一些网上的资料 ,利用PS来制作了十张流行词的解释图。

下面开始颁奖:

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

在这里插入图片描述

一千个人眼中就有一千个哈姆雷特。

相信每个人心里都有自己的一个流行语排行榜。

完整代码


import requests

from pyquery import PyQuery as pq

import pandas as pd

import time

import random

from fake_useragent import UserAgent

ua = UserAgent()

headers = {‘User-Agent’:ua.random}

def main():

data = []

n = 1

for i in range(4543,4550): #自己设置id范围

dic = {}

url = ‘https://www.lxybaike.com/index.php?doc-view-’+str(i)+‘.html’

print(‘已成功采集{}条数据’.format(n))

html = requests.get(url,headers=headers).text

doc = pq(html)

dic[‘tittle’] = doc(‘#doctitle’).text()

dic[‘num’] = doc(‘#doc-aside > div.columns.ctxx > ul > li:nth-child(1)’).text().replace(‘浏览次数:’,‘’).replace(’ 次’,‘’)

dic[‘zan’] = doc(‘#ding > span’).text().replace(‘[’,‘’).replace(‘]’,‘’)

dic[‘id’] = i

data.append(dic)

time.sleep(random.random())
自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。

深知大多数Python工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!

因此收集整理了一份《2024年Python开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。

img

img

img

img

img

img

既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!

由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新

如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)

合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!**

由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新

如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)

  • 3
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值