【NLP】推荐一些NER的英文数据集

 1   MUC Data Sets

https://www-nlpir.nist.gov/related_projects/muc/

 2   CoNLL-2002

https://www.clips.uantwerpen.be/conll2002/ner/

 3   CoNLL-2003

CoNLL 2003是由新闻通讯社的文章以四种不同的语言(西班牙语、荷兰语、英语和德语)创建的,重点关注4个实体:PER(人员),LOC(位置),ORG(组织)和MISC(其他,包括所有其他类型的实体)

https://www.clips.uantwerpen.be/conll2003/ner/

 4   2010 I2B2

2010 I2B2 NER任务考虑了临床数据,重点关注临床问题、测试和治疗实体类型

https://www.i2b2.org/NLP/Relations/

 5   DDIExtraction2013(Drug NER)

重点关注药品、品牌、集团和药品n(未批准或新药)实体类型

https://www.cs.york.ac.uk/semeval-2013/task9/index.html

 6   CHEMPROT(Similar to 5)

相比5更侧重于化学和药物实体,例如缩写、配方、家族、标识符等

https://biocreative.bioinformatics.udel.edu/

 7   microbiology NER datasets

从PubMed和生物学网站收集,并且主要关注细菌、栖息地和地理位置实体

http://2016.bionlp-st.org/tasks/bb2    

(需要FQ访问)

往期精彩回顾




适合初学者入门人工智能的路线及资料下载机器学习及深度学习笔记等资料打印机器学习在线手册深度学习笔记专辑《统计学习方法》的代码复现专辑
AI基础下载机器学习的数学基础专辑
  • 3
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值