把音频送进语音转文字模型之前先做降噪处理,效果会有巨大提升。这是Krisp给出的判断,它刚刚发布了一个开放的基准测试。

Krisp把这件事拆成了两个环节:一是削减噪音,二是把处理后的音频交给语音转文字模型。前一步做得好不好,直接决定后一步的输出质量。

打开网易新闻 查看精彩图片

语音隔离正在成为下一个重点

Krisp认为,语音隔离是接下来值得重点关注的方向。它没有停留在概念层面,而是选择用开放基准测试的方式,把这件事摆到台面上来比较。

对于做语音相关产品的团队来说,这个信号很直接:与其在转写模型上反复调优,不如先看看送进去的音频本身干不干净。