多麦克风做拾音的波束_新零售系列技术浅谈之一:语音交互之麦克风阵列

随着“互联网+”概念的普及,各个互联网大佬相继提出新零售,新制造的概念后,无人超市,无人售货柜等成为新零售的前沿阵地,而5G技术的发展催熟了物联网概念的普及,在5G尚未成熟商业落地之前,各种无线连接如4G,WiFi,蓝牙,NB-IoT等物联网技术蓬勃发展加速了新零售的落地,于是,天猫无人超市,便利蜂等新零售热点进入人们的眼帘。在这些热点的背后,人工智能技术的发展,进一步刷新了人们对新零售概念的认知,全新的体验也加强了人们对它的认可。

传统的人机交互,往往依赖于各种各样的输入设备如键盘,鼠标等等,输出则更多依赖于显示屏,这在一定程度上限制了无人自助技术的发展。于是让机器能听懂人说话或者能和人进行无障碍对话的语音交互技术开始走向台前。

语音交互,顾名思义,需要机器听懂你的意思,然后再给你语音反馈。整个链路分解下来包含拾音,语音识别,语义理解,语音播报等等关键技术。

拾音作为语音交互的第一环,相当于机器的耳朵。要让机器更好的聆听并且正确的理解你的意思,准确的拾音获取有效语音信息就显得无比重要。然而,作为宽带信号的语音信号,在封闭空间如室内的混响和多径效应特别显著,现实环境下有各种各样的噪声尤其是背景人声的影响,并且在室内环境下还会产生回声干扰等等。现行人机语音交互中,麦克风作为声电转换的唯一器件,充当着机器耳朵的功能,但是麦克风会将所有它能听到的声音转换为电信号,且根据声源和麦克风的远近又可以将声场模型分为远场和近场(远近场定义请参考百度),对于后处理一定程度上又增加了准确拾音的复杂度。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值