智猩猩AI整理

编辑:林夕

刚刚,Qwen3.8-Max迎来0902版本升级

Qwen官方宣布,新版本Qwen3.8-Max-0902正式上线,并明确表示,这一次进一步针对Coding & Cowork进行训练。

打开网易新闻 查看精彩图片

就在此次升级后,Qwen3.8-Max-0902刚刚在Code Arena: WebDev整体排名中以1691分首次登顶第1名,直接来到榜首。

打开网易新闻 查看精彩图片

这个成绩也让0902此次升级的重点更加清晰:Coding能力是这次强化的核心方向之一

Qwen3.8-Max此前已经是Qwen的旗舰模型。

公开资料显示,Qwen3.8-2.4T-A95B采用稀疏MoE架构,总参数达到2.4万亿,每个Token约激活950亿参数,上下文窗口最高可扩展至约100万Token。

而云端版本Qwen3.8-Max进一步加入了视觉输入、工具调用等生产环境能力,重点面向Coding、专业工作、科研以及长周期Agent任务。

与推出一个全新模型不同,这次0902并没有把重点放在继续扩大参数规模上,而是通过进一步的后训练,强化模型在真实工作环境中的表现。

官方给出的定位非常直接:2.4万亿参数、100万上下文,继续强化复杂任务

从此次放出的测试表来看,0902版也重点覆盖了大量Coding和Agent相关任务。

打开网易新闻 查看精彩图片

同时,0902依然强调了100万Token上下文对于Coding和Cowork来说,长上下文的重要性非常明显。

一个大型代码仓库可能就有几十万Token,一份科研资料、实验记录或者企业内部文档,也可能非常庞大。

如果模型只能看到其中一小部分,就很容易出现:前面看过的内容忘了,后面的内容又接不上。

而百万Token级上下文,可以让模型一次性容纳更大规模的工作环境。

这也是Qwen3.8-Max一直强调长周期任务的基础能力之一。官方云端版本目前仍提供最高约100万Token上下文窗口。

在价格方面,0902并没有带来明显的价格上涨,Qwen官方公布的Qwen3.8-Max-0902 API价格仍然非常有竞争力:

输入2美元/百万Token,输出6美元/百万Token。

缓存命中方面,显式缓存命中价格为0.17美元/百万Token,隐式缓存命中为0.25美元/百万Token

目前,Qwen3.8-Max-0902已经通过QwenCloud API正式上线

回头看Qwen3.8-Max的路线,会发现这次0902并不是突然转向,此前Qwen3.8-Max已经把目标从单轮问答进一步推向Coding、办公、科研、Agent和长周期任务

甚至在模型训练层面,也开始围绕真实环境、任务难度、工作空间和Harness建立更完整的训练体系。

而这次0902又进一步强化Coding & Cowork,某种程度上也说明Qwen正在继续把模型能力从回答问题推向完成任务。

关注+星标,获取AI前沿进展与开源一线动态