知识图谱与文献计量你一定做错了! citespace

来源微信公众号 【学术点滴】
在这里插入图片描述
本文仅以该图为案例,其他软件如VOSviewer做的图也存在各种问题

上图你一定很熟悉,利用CiteSpace软件制作的时区图(TimeZone)

该图通过关键词出现年份进行排列,用以展示主题的演化过程

具体原理可参考我之前的推文:《CiteSpace的时区图谱含义详细解读》

但是,该图存在一个致命问题

这个问题在以前并不是问题

而是随着期刊公开方式的变化而产生的

以前,中国知网公开的期刊都是已经印刷完成的,已经有纸质版本了,所以文章的发表时间是确定的了

但是,近年来随着期刊公开方式的转变,尚未印刷已经录用的文章会通过网络首发的方式进行公开,如下:

在这里插入图片描述

当纸质版印刷后,再把网络首发删除,公开正式版本

现在几乎每个期刊都会通过网路首发公开自己刚刚录用的文章,这是非常好的事情,能够让读者及时了解到最新研究成果,打破了文章从录用到出版的时滞问题

但是,网路首发的文章对于我们做文献计量与知识图谱就会存在致命问题

为什么呢?

因为网络首发的文章
缺失时间
缺失时间
缺失时间

缺失时间有什么重要后果呢?

比如,我们做时区图,有一个关键词是【新型冠状病毒】,显然该词出现于2020年,但是由于缺失时间,CiteSpace会默认补充一个1990年或者其他年份,这就出现问题啦。

同样针对研究前沿探测也会出现此问题

另外,VOSviewer软件也具备时间-关键词叠加图,由于网路首发导致的缺失时间,该软件也会出现相应的问题

上述缺陷会导致结果错误

而你可能并不知道

最终结果就是看着错误的图给出错误的解析

不知道你以前注意过此问题吗?

可能并没有,也可能注意到了但不知道如何解决

下面给出解决方案
中文数据利用Data数据园软件综合提取功能,看是哪篇文献缺失时间,然后回到原TXT文本里补充时间

英文数据利用WOS全字段挖掘软件综合提取功能,看是哪篇文献缺失时间,然后回到原TXT文本里补充时间

这个数据预处理功能一定要重视

  • 5
    点赞
  • 20
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值