跳跃NLP曲线:自然语言处理研究综述(五)(翻译)

6. 展望语义曲线

叙事理解和生成是推理,决策和“意识形成”的核心。除了作为人与人交流的关键部分之外,叙事也是构建现实和进行规划的手段。解读人类大脑如何生成和处理叙事可能最终导致我们真正理解和解释人类的智慧和意识。计算机建模是研究叙事理解的有效方法。在知识表达,常识推理,社会认知,学习和NLP的保护下,人工智能研究人员一直关注导致人类理解或产生叙事的许多认知过程。一旦NLP研究能够在与人类文本处理相当的水平上掌握语义,跳跃到语用学曲线将是必要的,就像语义机器学习现在逐渐从词汇学习到组合语义学一样。已经有一些先锋作品试图通过利用话语结构来理解叙事,参数支持层次结构,规划图,和常识性推理。在此背景下最具代表性的举措之一是Patrick Winston基于叙事的计算机模型工作,即基于五个关键假设的叙事计算模型:

  • 内在语言假设:我们有一种内在的符号语言,可以实现事件描述
  • 强烈的故事假设:我们可以将事件描述汇集到故事中。
  • 定向感知假设:我们可以指导我们感性的资源,用真实和想象的情境回答问题。
  • 社会动物假说:我们有一个强有力的理由在外部沟通语言中用我们的内在语言表达思想。
  • 异乎寻常的工程假设:我们的大脑与标准的从左到右的工程系统不同。

从本质上来讲,Patrick Winston认为人类智慧来源于我们讲故事和理解的独特能力。因此,他最近的工作重点是开发一种能够分析叙事文本的计算系统,以推断出对这些文本的问题的非显而易见的答案。这产生了Genesis系统。使用英语描述的短篇小说摘要以及低级别常识规则和更高层次的反思模式,Genesis已经成功地展示了几个故事的理解能力。其中一个例子就是它能够确定麦克白和2007年俄罗斯 - 爱沙尼亚网络战都涉及复仇,尽管在描述这些文本的叙述中都没有提到“复仇”这个词或其任何同义词。

7. 讨论

NLP的单词和概念级方法只是迈向自然语言理解的第一步。NLP的未来在于生物学和语言学推动的计算范式,使叙事理解成为可能,因而也就是“意义上的”。计算智能在NLP的未来研究中发挥重要作用具有很大的可能性。例如,模糊逻辑与情绪分析,语言概括,知识表示和词义推理等任务的NLP有直接关系。人工神经网络可以帮助完成NLP任务,例如模糊度解析,语法推理,单词表示和情感识别。进化计算可以用于诸如语法进化之类的任务,知识发现,文本分类和规则学习。

然而,尽管它具有潜力,但迄今为止,计算智能技术的使用在NLP领域尚未如此活跃。第一个原因是NLP是一个巨大的领域,目前正在解决存在特定评估指标的几十个不同问题,并且不可能将整个领域缩小为特定问题,因为它是在早期工作中完成的。第二个原因可能是支持向量机,核主成分分析和潜在Dirichlet分配等强大的技术已经在广泛使用的NLP数据集上取得了显着的成果,而这些数据集还没有被计算智能技术所满足。然而,所有这些基于单词的算法都受到以下事实的限制:它们只能处理它们可以“看到”的信息,因此迟早会达到饱和状态。相反,计算智能技术可以通过模仿人类大脑处理自然语言的方式来超越文档的句法表示(例如,通过利用未在文本中明确表达的语义特征)。因此,有更高的潜力来解决互补的NLP任务。例如,可以在相同的NLP模型中利用计算智能技术的集合来进行自然语言概念的在线学习(通过神经网络),概念分类和语义特征泛化(通过模糊集),和概念意义进化和连续系统优化(通过进化计算)。

8. 总结

在用户生成的内容已达到临界质量的Web中,需要合理的计算和信息聚合正呈指数级增长,正如业界对“大数据专家”的“疯狂热潮”以及新的“数据科学”学科的发展所证明的那样。网络内容创作的民主化导致网络碎片的增加,这对信息检索和提取不可避免地产生负面影响。为了分析这种消极趋势并提出可能的解决方案,本综述文章根据三种不同的范例,重点关注NLP研究的演变,即:词包,概念包和叙述包模型。这篇综论文章借鉴了商业管理领域的“跳跃曲线”概念,解释了NLP研究如何以及为何逐渐从词汇语义转向组合语义,并提供了对下一代基于叙事的NLP技术的见解。

然而,跳跃曲线并非易事:人类语言的起源有时被称为最难的科学问题。NLP技术从打卡到批处理时代发展过来(其中自然语言句子的分析从以前需要7分钟)到现在谷歌的时代(不到一秒钟的时间内处理数百万个网页)。然而,即使是最有效的基于单词的算法,如果不是经过适当训练或在上下文和域名发生变化时,也表现得非常差。这些算法受到以下事实的限制:它们只能处理他们可以“看到”的信息。然而,语言是一个所有术语相互依赖的系统,其中一个术语的价值是其他术语同时存在的结果。作为人类文本处理器,我们“看到的不仅仅是我们所看到的”,其中每个单词都激活了一系列与语义相关的概念,这些概念可以以快速和轻松的方式完成复杂的NLP任务,例如词义消歧,文本蕴涵和语义角色标记。

概念是将我们的心灵世界联系在一起的粘合剂。没有概念,首先就没有心理世界。 毋庸置疑,将知识组织到概念中的能力是人类思维的定义特征之一。 一个真正智能的系统需要有关物体行为方式的物理知识,人们如何互动的社会知识,事物外观和品味的感官知识,人们思考方式的心理知识等等。然而,拥有数百万常识事实的数据库对于计算自然语言理解是不够的:我们需要教授NLP系统如何处理这些知识(IQ),还需要解释情绪(EQ)和文化差异(CQ))。

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值