一次完整的python分析+可视化展示,是什么样的?
比如我想知道知乎用户的学历,是否都是985呢?我还想知道知乎最受关注的话题都是些什么?高端人士都喜欢看什么书呢?“人在XX,刚下飞机?”这句话出现的频率有多高呢?
最快的方法是用python爬虫然后加BI可视化分析!python爬虫仅需几步就可以完成:
- 找到网页URL,查看HTML代码
- 在HTML代码中找到你要提取的数据
- 写python进行网页请求和解析
- 存储数据,Excel导出
于是我使用10000秒的时间写了5000行代码,爬取了知乎下5646个话题与回答,10W+用户,和我预想的结果完全不一样。
我们先放一部分代码,完整的可以到文末看评论~
最后爬取了大概快60W的数据,我们接下来要对它进行数字可视化的分析。