国家知识产权局信息显示,云知声智能科技股份有限公司、中国科学技术大学申请一项名为“一种语音理解方法及语音理解模型的训练方法”的专利,公开号CN122867687A,申请日期为2026年7月。

专利摘要显示,本申请公开了一种语音理解方法及语音理解模型的训练方法。通过对声学特征进行下采样得到声学嵌入序列,使得输入语言模型的序列长度相较于帧级声学特征大幅缩短,从而降低了语言模型处理音频数据时的计算开销和资源占用;同时由于将文字单元、说话人标识和时间标记单元统一纳入语言模型自回归生成的同一输出序列中,语音识别、说话人区分与时间对齐在同一模型内协同完成,文字层面的语义线索可以参与说话人区分,避免了多模型级联带来的链路冗长问题;并且由于时间标记单元仅用于占位以触发时间预测,而具体时间位置通过将粗粒度的时间单元定位与细粒度的单元内偏移相结合确定的,有利于在序列长度较短的前提下仍能得到较细的时间分辨率。

声明:市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

本文源自:市场资讯

作者:情报员