8月5日,腾讯混元AI团队正式发布新一代语音识别模型Hy ASR 3.0 preview预览版,依托混元大模型Hy3的超强语言理解能力,实现复杂场景语音识别精度与语义理解效果的全面升级。
打开网易新闻 查看精彩图片
相较于前代产品,Hy ASR 3.0模型突破了传统语音识别仅依赖声学信号的技术局限,深度融合大模型语义理解能力,能够精准适配真实复杂应用场景。针对环境噪音干扰、多人对话重叠、口语化表达、方言混杂、语句省略等复杂输入场景,该模型均可输出准确、连贯、贴合用户真实意图的文字转写结果。
据腾讯官方介绍,全新的Hy ASR 3.0模型在通用场景、办公场景、生活服务场景的识别准确率均实现大幅提升,同时优化了实时转写延迟,适配直播字幕、会议记录、智能客服、语音输入、车载交互等多元化落地场景。
此次语音识别模型的迭代升级,进一步完善了腾讯混元AI的全场景技术矩阵,补齐了语音交互细分领域的技术短板,为大模型落地消费级、产业级智能交互场景提供了更强的技术支撑,也将推动行业语音智能交互体验的整体升级。
热门跟贴