NER论文阅读笔记:Boundary Enhanced Neural Span Classification for Nested Named Entity Recognition

       命名实体识别(NER)是自然语言处理中研究较多的一项任务。然而,广泛使用的序列标记框架通常难以检测出嵌套结构的实体。基于文本片段的方法可以很容易地检测出不同子序列中的嵌套实体,这自然适合于嵌套NER问题。然而,基于文本片段的方法有两个主要问题。首先,对所有子序列进行分类在计算上是昂贵的,而且在推理方面非常低效。其次,基于文本片段的方法主要关注学习片段表征,缺乏明确的边界监督。为了解决上述两个问题,我们提出了一种边界增强的神经网络文本片段分类模型。除了对文本片段进行分类之外,我们提出增加一个额外的边界检测任务来预测那些属于实体边界的单词。在多任务学习框架下对这两个任务进行联合训练,通过增加边界监督来增强跨度表示。此外,边界检测模型具有生成高质量候选片段的能力,大大降低了推理时的时间复杂度。实验表明,该方法在ACE2004、ACE2005和GENIA数据集上分别取得了85.3、83.9和78.3的F1分数,优于现有的所有方法。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值