从近讲到远场 小米自研语音技术让用户“自由场景自由说”

1评论 2020-01-17 15:18:10 来源:TechWeb.com.cn 游资是怎么抓涨停的?

  【TechWeb】智能语音行业已经进入蓬勃发展的时代,随着智能设备的逐渐增多,用户对语音交互的需求越来越大。在AIoT时代,智能设备的自然语言交互能力成为与用户沟通的重要一环。当用户对智能设备产生需求并进行对话时,语音的唤醒和识别能力直接决定了用户对设备的好感度。

  依托于小爱同学、小米多款智能设备,小米持续深耕语音技术,希望在智能家庭、智能车载等丰富的使用场景之下,更进一步解放对用户语音识别环境的条件限制,让用户体验更自然、更自由、无压力的语音交互方式,更好地理解用户意图,为用户提供极致的智能语音交互体验。

  多通道端到端语音技术,让用户在“自由场景自由说”

  目前,业内各家的近讲语音唤醒和识别能力已经达到了较高的水平,在近距离、安静的环境下,用户与智能设备的语音交互已经基本无障碍。然而,在强噪声干扰、强房间混响、说话距离远、设备自身播放音源等条件下,智能设备与用户进行连续地自然语音交互仍然具有挑战性。

  如何让远场语音性能达到和近讲相近的水平,一直是困扰业界语音工程师的一大难题。鉴于此,小米语音团队的“多通道端到端语音技术”自研能力,取得比“传统多通道阵列增强模块加单通道语音技术”更好的性能。

  为了在远场声音中更准确的识别出目标语音,传统多通道阵列增强技术会使用空间滤波或语音分离算法,但这些算法引入了较多先验假设,在一些不符合假设的场景下,性能会明显下降。另外,传统多通道阵列处理技术是由多个技术模块串联组成,多个麦克风的数据会被送入回声消除、降噪、去混响、寻向和波束形成等模块,几个模块单独进行优化,优化目标并不一致。

  小米从2018年开始验证端到端语音唤醒和识别的思路,目标即从充满噪声、混响和回声的多个麦克风中直接学习语音特征,提升真实环境中的识别率和稳定性。经过一系列的校验,小米多通道端到端语音技术有三大明显优势。第一,端上的计算量变小,较之前减少了50%,缩短了所有的计算路径和时长;其次,端上的存储量变小,在原有的基础上大幅减少,减轻了存储压力;最后,“多通道端到端语音技术”直接用一个网络中的不同级去替代之前的多个模块,最后有一个一致的优化目标,避免误差的逐级传播。整个模型用一套神经网络表述,大幅减小系统设计复杂度,可以明显降低运算负荷。从大规模训练数据中习得的深度神经网络,比基于传统信号处理的方式,使用的先验假设少,可以涵盖更多的实际场景

  从近讲到远场,小米自研技术拓宽了语音的想象力

  据小米语音工程师介绍,尽管传统信号处理具有一些方面的不足,但是其能够较好地处理麦克风阵列信号的相位,利用物理学中朴素的法则“同向相加,异向相消”对不想要的信号分量进行抑制。因此,小米的多通道语音识别模型不仅采用了更先进的深度神经网络,也同时继承了传统信号处理理论对相位处理的精髓,将传统前端算法和深度神经网络的优势进行互补,也即将传统信号处理的概念进一步拓展,充分利用深度神经网络的非线性处理能力,提出一种全神经网络语音识别模型。

  在语音识别大牛Daniel Povey加入小米后,小米的语音交互在原有的基础上更进一步。终于让多通道端到端语音方案性能超过了传统方案。经过数据测试,多通道端到端语音技术让远场语音识别性能相对提升了10%,使用户与智能设备的交互更加顺畅。

  从3G时代,到4G时代,再到5G时代,智能语音交互也发生着巨大的变革。多通道端到端的语音技术不仅让用户交互方式更加自由,同时也降低了硬件的产品功耗。从近讲的唤醒识别到远场的唤醒识别,从单通道到多通道,小米自研语音技术旨在帮助用户在自由的场景下实现自由说的目标。未来,小米将智能语音技术落地至更多应用场景,不断突破自研技术,为用户提供更加极致的语音交互体验。

责任编辑:Robot RF13015
快来分享:
评论 已有 0 条评论
精彩推荐
超重磅发声!政治局定调6大方向 确定发行特别国债!625字力促经济 适当提高财政赤字率 引导利率下行

2020-03-28 01:43:20来源:券商中国

美国确诊病例突破10万!美股尾盘再次跳水 特朗普签署史上最大经济刺激方案

2020-03-28 08:18:20来源:e公司官微

券业又见利好!并表试点落地 中信华泰中金等6家券商入围!

2020-03-28 11:34:45来源:券商中国

茅台断供贵州白酒交易所后果很严重 背后牵涉这位资本大佬

2020-03-27 20:52:46来源:e公司官微

逆周期调节政策加码 二季度经济增速料反弹

2020-03-28 05:43:05来源:中国证券报

高盛大摩喜提中国公司控股权!外资控股券商扩至5家 纯外资券商争夺战打响

2020-03-28 17:43:29来源:券商中国

一天新增近2万 累计确诊破10万!美国或成疫情“震中” 特朗普:赶紧生产呼吸机

2020-03-28 08:18:52来源:每日经济新闻

华尔街“大地震”!量化三巨头都栽了

2020-03-27 07:32:45来源:中国基金报

医保局:全国新冠肺炎确诊患者人均治疗费用1.7万

2020-03-29 11:07:40来源:央视

钟南山:按照推断 中国没有大量的“无症状感染者”

2020-03-29 10:50:49来源:央视

又一地出手鼓励汽车消费!宁波:每辆车一次性让利5000

2020-03-28 07:44:14来源:中新经纬

年报也扎堆!七家券商一起来: 广发招商净赚超70亿 这两家暴增四倍多!

2020-03-28 06:39:45来源:中国基金报

国家卫健委:3月28日新增确诊病例45例 境外输入病例44例

2020-03-29 07:51:07来源:金融界网站

上市公司透露基金公司2019年业绩 有公司赚17亿 有公司连续亏损

2020-03-28 06:43:20来源:中国证券报

中共中央政治局:加强农作物病虫害防治和气象灾害防范

2020-03-27 19:15:58来源:金融界网站

史上最贵串门!隔离期间深圳球员离开房间串门 被罚50万

2020-03-29 08:34:20来源:每日经济新闻

中共中央政治局:扩大居民消费 合理增加公共消费

2020-03-27 19:15:23来源:金融界网站

中共中央政治局:引导贷款市场利率下行

2020-03-27 19:11:53来源:金融界网站

笑傲投资:现在看空的理由

2020-03-27 09:32:51来源:全球财说

肖磊:美国遏制中国的战略会因为疫情受阻吗?

2020-03-27 10:15:00来源:金融界网站

加载更多

更多>> 以下为您的最近访问股
全网|财经|股票|理财 24小时点击排行