语音转文字(ASR)技术已经相当成熟,但转录结果往往带着口语化表达、重复词和语气词,距离可直接使用的书面文本还有一段距离。Superwhisper 团队推出的 S1-mini,正是为解决这一痛点而生。
这款模型的体积仅有 462 MB,参数量为 0.6B,属于典型的轻量级开放权重模型。它做的事情很聚焦:把原始 ASR 转录文本规范化,整理成干净、通顺的书面表达。
打开网易新闻 查看精彩图片
三轴控制,精准改写
S1-mini 的核心机制是一条三轴控制线,让用户能够按需调整输出结果。这意味着它不只是简单地删掉语气词,而是能在多个维度上控制改写方向,让最终文本更贴合使用场景。
对于依赖语音输入的内容创作者、记者或商务人士来说,这类工具能显著减少后期编辑时间。而开放权重的策略,也让开发者可以将其集成到自有工作流中,不必受限于云端 API 的调用成本。
在追求大参数模型的主流叙事之外,S1-mini 展示了另一条路径:用轻量模型解决具体问题,把选择权交还给用户。
热门跟贴