论文作者统计（pandas字符串操作）

蓝棠

于 2021-01-17 02:11:12 发布

阅读量609

点赞数 1

分类专栏： pandas 文章标签： python 开发语言后端

本文链接：https://blog.csdn.net/qq_43720646/article/details/112727574

版权

github
涉及知识点如下：
1、data[‘categories’].apply(lambda x: ‘cs.CV’ in x)结果理解
2、sum函数的嵌套列表元素合并
3、dataframe和series中value_counts函数的使用

代码如下：

# 导入所需的package
import json #读取数据，我们的数据为json格式的
import pandas as pd #数据处理，数据分析
import matplotlib.pyplot as plt #画图工具

# 选择类别为cs.CV下面的论文
data2 = data[data['categories'].apply(lambda x: 'cs.CV' in x)]

# 拼接所有作者
all_authors = sum(data2['authors_parsed'

关注

专栏目录