谷歌解读免费实时转录软件:面向听障人士 支持70种语言

640?wx_fmt=png

640?wx_fmt=png

来源 | 网易科技(公众号:tech_163)

作者 | 定西


近日,谷歌邀请媒体在京举行视频电话会议,谷歌产品经理Sagar Savla介绍了Live Transcribe软件,这是一项免费的Android服务,通过将自动字幕技术融入日常会话,减少现实世界中的对话障碍。


据了解,通过自动语音识别技术 (ASR),计算机能够检测有声语言并将其现场转录为供阅读的文本,由Google云提供技术支持,Live Transcribe可以进行实时的对话字幕转录,支持超过70种语言,覆盖全球80%以上的人口。

Sagar Savla表示,虽然依靠云ASR能为我们提供更高的准确性,但Google希望可以减少Live Transcribe所需的网络流量消耗。为此,Google在先前AudioSet的工作基础上,实现了基于神经网络的设备语音检测器。该网络是一种图像式模型,类似于我们之前发布的VGGish模型,它可以检测语音并自动管理与云ASR引擎的网络连接,将长时间使用过程中的数据流量消耗降至最低。


在技术呈现方面,Google曾考虑了几种不同的模式:计算机、平板电脑、智能手机、小型投影仪,以迭代方式显示听觉信息和字幕。最后,Sagar Savla的团队决定专注于智能手机模式,因为这类设备无处不在且功能日益强大。

640?wx_fmt=jpeg(软件使用量热度图)


资料显示,世界卫生组织预计,到2055年全球将有九亿人听力受损。谷歌的这项软件可以为他们带去便利。目前该软件在亚洲已经非常流行。



640?wx_fmt=png

往期推荐

640?wx_fmt=png


社交网站上的照片,也许已经被用来训练人工智能

640?wx_fmt=jpeg ▲点击图片观看

剖析20世纪未来出行 这些畅想21世纪能成吗?

640?wx_fmt=jpeg
▲点击图片观看

是“洗稿”还是“创作”?AI画作所有权该归谁?

640?wx_fmt=jpeg

▲点击图片观看


- 加入社群吧 -

网易智能AI社群(AI芯片、医疗AI、金融AI、电商AI、自动驾驶、教育AI、AIoT、机器人等12个社群)火热招募中,对AI感兴趣的小伙伴,添加智能菌微信 kaiwu_club,说明身份即可加入。

640?wx_fmt=png

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值