命名实体识别(NER)是自然语言处理中研究较多的一项任务。然而,广泛使用的序列标记框架通常难以检测出嵌套结构的实体。基于文本片段的方法可以很容易地检测出不同子序列中的嵌套实体,这自然适合于嵌套NER问题。然而,基于文本片段的方法有两个主要问题。首先,对所有子序列进行分类在计算上是昂贵的,而且在推理方面非常低效。其次,基于文本片段的方法主要关注学习片段表征,缺乏明确的边界监督。为了解决上述两个问题,我们提出了一种边界增强的神经网络文本片段分类模型。除了对文本片段进行分类之外,我们提出增加一个额外的边界检测任务来预测那些属于实体边界的单词。在多任务学习框架下对这两个任务进行联合训练,通过增加边界监督来增强跨度表示。此外,边界检测模型具有生成高质量候选片段的能力,大大降低了推理时的时间复杂度。实验表明,该方法在ACE2004、ACE2005和GENIA数据集上分别取得了85.3、83.9和78.3的F1分数,优于现有的所有方法。
NER论文阅读笔记:Boundary Enhanced Neural Span Classification for Nested Named Entity Recognition
最新推荐文章于 2023-09-27 21:19:48 发布