阿里发布了音视频多模态模型 Qwen3.8-Omni-Flash。它支持 1M 上下文,具备工具调用能力,并且大幅减少了 Token 消耗。
一个值得注意的细节是:这款模型仅提供 API,没有开放权重下载。
三个关键点
音视频多模态加上长上下文,指向的是需要同时理解画面和声音、且素材体量不小的场景。Token 消耗降下来,意味着同样的任务花更少的钱。
只给 API 不给权重,说明阿里把这款模型放在云端服务的位置上,而不是让开发者自己部署。
阿里发布了音视频多模态模型 Qwen3.8-Omni-Flash。它支持 1M 上下文,具备工具调用能力,并且大幅减少了 Token 消耗。
一个值得注意的细节是:这款模型仅提供 API,没有开放权重下载。
三个关键点
音视频多模态加上长上下文,指向的是需要同时理解画面和声音、且素材体量不小的场景。Token 消耗降下来,意味着同样的任务花更少的钱。
只给 API 不给权重,说明阿里把这款模型放在云端服务的位置上,而不是让开发者自己部署。
热门跟贴