阿里云把自家大模型又往前推了一步。Qwen3.8-Max 升级为 Qwen3.8-Max-0902,参数量直接拉到 2.4T,上下文窗口支持 1M token。这个体量,放在当前开源和闭源模型里都属于第一梯队。
这次升级的重点不在参数规模本身,而在训练方向。官方明确提到,新版本针对 Coding & Cowork(编码与协作)做了进一步后训练。也就是说,模型不是单纯变大,而是专门在代码生成和多人协作场景上又磨了一遍。
打开网易新闻 查看精彩图片
从应用场景看,这种针对性训练带来的提升,主要体现在三类任务上:复杂企业任务、科学研究和长周期工作流。这些场景的共同点是步骤多、依赖关系复杂,对模型的上下文理解和持续跟踪能力要求极高。
打开网易新闻 查看精彩图片
1M token 的上下文窗口,意味着模型可以一次性处理超长代码库或整份技术文档,不用频繁切分。配合针对协作场景的后训练,它在多人共同维护的项目里,对代码上下文的理解会更连贯。
阿里云这次没有公布具体的评测数据,但从模型定位来看,明显是在跟企业级应用较劲。大参数加长上下文,再加场景化训练,这套组合拳指向的正是那些真正需要处理海量代码和复杂流程的团队。
热门跟贴