Qwen3.8-27B 在编程基准测试中拿下第 9 名
阿里巴巴 Qwen 团队发布的 Qwen3.8-27B,在 Code Arena WebDev 排行榜上以 1595 分 获得总体第 9 名。这一成绩使其成为自身参数规模类别中唯一进入前 10 的模型。
从排名看,该模型仅落后于更大的 Qwen3.8-Max 六名,同时远超排名第 80 的 Gemma 4-31B。Qwen 团队在公告中强调,这一结果凸显了该模型相对其规模所具备的编码能力。
同规模模型中的突出位置
Code Arena 的榜单通常被更大参数模型占据,Qwen3.8-27B 以较小体量挤进前十,意味着它在效率与性能之间取得了较为少见的平衡。与 Qwen3.8-Max 的差距只有六个位次,也说明其实际编码表现并未因规模缩小而大幅滑坡。
相比之下,Gemma 4-31B 虽然参数更多,排名却落在第 80 位。这一对比进一步放大了 Qwen3.8-27B 在同类基准中的相对优势。
热门跟贴