PS:如有需要Python学习资料的小伙伴可以加点击下方链接自行获取
知乎,可以说是国内目前最大的问答类社区。与微博、贴吧等产品不同,知乎上面的内容更多是用户针对特定的问题分享知识、经验和见解。
大V的关联
首先给大家看的是知乎上粉丝数前50用户的关系图:
图中的线是用户之间的相互关注的关系。这三张图的差别只在圆圈的大小上,依次分别代表:粉丝数、连入度(被图中其他人关注的数量)、连出度(关注图中其他人的数量)
比较明显的是,像知乎日报、刘看山、丁香医生这类普通用户关注较多的“机构号”,在大V中的受关注度并不高。
这张图是通过一个叫做 Gephi 的软件,基于 Python 采集下来的数据做出来的。其中圈的颜色是 Gephi 根据关联关系自动聚合的结果。
知乎的四大指标:关注、赞同、感谢、收藏。我们分别看下以不同指标排行的“头部用户”:
其中,张佳玮可以说是非常突出了。(这个名字好熟悉……还记得之前的虎扑分析吗?)
官方收录回答数,张佳玮还是遥遥领先,收录文章数也榜上有名。
如果不论质量,仅看数量的话:
把这几组数据合成了两张三维散点图:
图中选取的数据为关注数大于1万的用户。在项目里有可以交互的网页版本,可以更直观的查看这个分布图。
大V的热情在消退?
上面几张图是对目前关注数超10万的用户的历史发布数据进行的统计。从图上来看,2015年大V们更热衷于回答,后来则大都改去写专栏文章了。从趋势来看,似乎大V们发文的频率已不再增长。不过这并不能直接推断知乎的整体热度,也可能内容的产出更分散于不同用户了呢?这就只有知乎官方才有权威数据了。
用户爱看什么?
这些关注度最高专栏和收藏夹,里面有你关注的吗?
最后,这是一个以关注数超1万的用户的个人简介做出来的词云:
coding:utf8
抓取粉丝数过 1w 用户
import requests
import pymongo
import time
import pickle
def get_ready(ch=‘user_pd’,dbname=‘test’):
‘’‘数据库调用’‘’
global mycol, myclient,myhp
myclient = pymongo.MongoClient(“mongodb://localhost:27017/”)
mydb = myclient[dbname]
mycol = mydb[ch]
get_ready()
ss = mycol.find({})
se = {1,} # 去重集合
se2 = [‘GOUKI9999’,‘zhang-jia-wei’] # 爬取的列表
with open(r’C:\Users\yc\Desktop\used.txt’, ‘rb’) as f: # 读取
used = pickle.load(f)
used={1,}
sed = {}
for s in ss:
if s[‘follower_count’]>=10000: # 粉丝数大于10000
sed[s[‘user_id’]] = sed.get(s[‘user_id’],0) + 1
if sed[s[‘user_id’]] == 1:
se.add(s[‘user_id’])
se2.append(s[‘user_id’])
leng = len(se2)
print(leng)
proxies = {
“http”: “http://spiderbeg:pythonbe@106.52.85.210:8000”,
“https”: “http://spiderbeg:pythonbe@106.52.85.210:8000”,
}
自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。
深知大多数Python工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!
因此收集整理了一份《2024年Python开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。
既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新
如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)
7243c1008edf79.png)
既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上前端开发知识点,真正体系化!
由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新
如果你觉得这些内容对你有帮助,可以扫码获取!!!(备注:Python)