奥音贝参与世界机器人大会AI 智能声学方案赋能人形机器人自然交互
生活百科讯
2026年8月19-23日,2026世界机器人大会在北京北人亦创国际会展中心隆重举办。本届大会以“人机共生,产需共融” 为主题,汇聚机器人领域专家学者、整机企业与产业链上下游,聚焦人形机器人产业化落地,围绕前沿技术创新、场景商业化应用开展深度研讨。北京奥音贝科技有限公司作为 AI 智能声学感知领域技术企业,以产业技术交流形式参与本次盛会,输出面向人形机器人的全栈AI智能声学解决方案,共探机器人听觉感知技术发展新路径。
本届世界机器人大会重点聚焦人形机器人从技术演示走向实际落地,行业普遍认为,高性能听觉感知是人形机器人实现真实世界人机交互的核心基础。机器人想要真正融入家庭、工业、商业等现实场景,需要具备 “听得清、听得准、听得懂、交互自然” 的完整听觉能力,解决复杂环境下噪声干扰、回声抑制、空间声源定位等现实技术痛点。
奥音贝专注 AI 智能声学感知技术研发,面向人形机器人提供软硬一体化 AI 智能声学解决方案,为机器人打造完整的听觉感知能力。方案集成关键词唤醒 (KWS)、环境噪声消除 (ANS)、自动增益控制 (AGC)、回声消除 (AEC)、波束成形 (BF)、声源定位 (SSL)、MEMS 麦克风阵列、扬声器模组八大核心能力。
声音采集单元:可以设计、定制环形、线形、异形等 MEMS 阵列。不同阵形支持不同波束效果,线形阵列支持 4 麦到 12 麦阵元数量,环形阵列支持 4 麦到 6 麦阵元数量。
扬声器单元:额定阻抗 4Ω,额定功率 2.0W,最大功率 3.0W,谐振频率 600Hz±50Hz,声压级 100.5dB±3dB。外形尺寸 38×13×3mm,超薄设计适用于便携设备,中高频声压输出稳定,高频失真低。
环境噪声消除算法:可以消除人声外的1000多种环境噪声,大幅度改进采集质量。
声音定位算法:采用麦克风阵列波束成形技术,线性阵列实现180°半平面声源定位,分辨率5°,环形阵列实现 360°全向定位,分辨率1°。结合DOA方向估计,可返回唤醒角度信息,支持串口实时获取,适用于机器人语音导航与运动控制。
回声消除算法:采用自适应滤波结合频域分块处理,支持 16–48kHz 采样率、单双声道。在双讲场景下保持语音质量。
自动增益算法:输入动态范围 30–80dB SPL,输出电平稳定在-20 至-10dBFS。增益调整范围0–40dB。采用自适应电平检测与压缩/扩展结合策略,支持16–48kHz采样率。语音活动检测(VAD)联动,静默段不增益放大。
通过多通道信号处理、自适应降噪算法、3D 空间声源定位技术,在嘈杂、多回声等复杂现实环境中,实现远近场高保真拾音,精准定位声源方向,保障语音识别稳定可靠,支撑流畅自然的人机对话,让机器人更懂人类指令与环境信息。
该套声学解决方案可广泛适配多类机器人载体:面向家庭服务机器人,实现老人陪护、家庭语音交互;面向工业人形机器人,完成语音指令控制、声学状态监测与安全预警告警;面向商业服务机器人,支撑展厅讲解、客服接待;同时也可满足特种机器人复杂环境感知、远距离通信、声源定位导航的严苛需求。目前相关技术已与松延动力、立讯精密等行业企业达成深度合作,服务多个行业,覆盖消费电子、智能制造、服务机器人等多个赛道,在复杂真实场景下验证了方案的可靠性。
奥音贝相关负责人表示:“人形机器人产业正在加速迈向实用化阶段,单纯的语音识别能力已经无法满足真实场景需求,复杂环境下完整的声学感知能力,是实现高质量人机交互的关键。奥音贝持续深耕机器人听觉赛道,坚持面向产业化落地做技术打磨,为整机客户提供高适配、高可靠的全栈声学解决方案,解决现实场景中的噪声、回声、空间感知等实际问题。期待与产业链伙伴协同创新,共同推动人形机器人技术迭代与商业化落地,助力‘人机共生’产业生态建设。”
未来,奥音贝将持续迭代AI声学感知技术,拓展更多机器人场景解决方案,携手产业链伙伴,共同推动我国人形机器人产业高质量发展。
热门跟贴