阿里云旗下AI团队Qwen正式发布了Qwen3.8系列模型,并采用Apache 2.0协议开放权重。其中最受关注的核心模型Qwen3.8-27B,拥有270亿参数,属于多模态密集架构。根据官方公布的数据,这款27B模型在编程和办公任务上,性能超越了参数规模更大的Qwen3.7-Plus,形成以小博大的技术看点。 除了性能表现,Qwen团队还强调了智能体(Agent)能力的升级。新模型在规划任务时更加独立,执行动作的可靠性也明显提升。上下文处理方面,Qwen3.8-27B原生支持最高26.2万token的上下文窗口,并可通过YaRN方法扩展到100万token。多模态能力覆盖图片、视频、图表、文档乃至长达数小时的视频内容,适用场景相当广泛。 值得注意的是,模型默认启用了灵活的思考模式,但用户可根据具体查询需求手动切换关闭,以便在速度和深度之间取得平衡。 此次发布还包括一个体量更大的版本Qwen3.8-2.4T-A95B,该模型面向Max级别性能设计。两个模型的权重均已上传至Hugging Face和ModelScope平台,开发者可直接下载使用。与此同时,阿里云旗下的Qwen Cloud也即将提供托管版本,支持百万token上下文,方便企业级用户快速接入。

打开网易新闻 查看精彩图片