语音识别新范式：完全的“端到端”模型优势在哪里？

Recurrent_AI

于 2020-03-11 09:17:13 发布

阅读量1.3k

点赞数 1

文章标签：语音识别深度学习自然语言处理

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/Recurrent2020/article/details/104789286

版权

目录

语音识别新范式

Transformer-XL 进一步释放注意力模型的优势

从学术前沿到商业落地

“自然科学的发展除了按常规科学一点一滴地积累之外，还必然要出现‘科学革命’。”托马斯·库恩在其发表于 1962 年的经典著作《科学革命的结构》中提出的“范式转换”一词，如今已成为大家耳熟能详的技术用语。

大的“范式转换”存在于基础科学领域，小的“范式转化”也存在于几乎每个细分的技术领域。

语音识别新范式

以自然语言处理的子领域“语音识别”为例，从 2012 年引入深度学习技术开始，语音识别的研究热点经历了三个阶段：

2011年前后，基于 DNN+HMM（深度神经网络+隐马尔科夫模型）的语音识别

2014年前后，基于 LSTM+CTC（长短时记忆网络+连接时序分类）的不完全端到端语音识别

2017年前后，基于 Transformer（自注意力机制）的完全端到端语音识别

如果说 2011 年深度学习的引入，是语音识别领域上一次范式转换的起点，那么从 2017 年开始，基于注意力机制和 Transformer 新型神经网络结构的语音识别研究，无疑标志着语音识别的新范式正在形成。

最低0.47元/天解锁文章

关注

1
点赞
踩
6

收藏

觉得还不错? 一键收藏
0
评论
语音识别新范式：完全的“端到端”模型优势在哪里？

目录语音识别新范式Transformer-XL 进一步释放注意力模型的优势从学术前沿到商业落地“自然科学的发展除了按常规科学一点一滴地积累之外，还必然要出现‘科学革命’。”托马斯·库恩在其发表于 1962 年的经典著作《科学革命的结构》中提出的“范式转换”一词，如今已成为大家耳熟能详的技术用语。大的“范式转换”存在于基础科学领域，小的“范式转化”也存在于几乎每个细分的技术...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。