阿里巴巴Qwen3.8正式发布:2.4万亿参数国产大模型编程能力突破

打开网易新闻 查看精彩图片

阿里巴巴于8月3日正式发布新一代基座大模型Qwen3.8,总参数量高达2.4万亿,是继Kimi K3之后国产大模型"两万亿俱乐部"的第二位成员。在权威榜单Arena中,Qwen模型仅次于Anthropic的Claude系列,整体性能稳居全球第一梯队。

核心能力突破与自主编程里程碑

阿里巴巴Qwen3.8在编程(Coding)和专业办公(Cowork)两大核心维度实现关键突破,标志着国产大模型从"辅助工具"向"自主工程师"的角色演进。在编程领域,CodeArena榜单显示Qwen3.8位居全球第四,超越多数国际旗舰模型。更值得关注的是,Qwen3.8实现了从"写函数补代码"到"从零交付完整项目"的质变。在一个真实演示中,仅需一句"创建一个自进化的智能体Harness"指令,Qwen3.8从空文件夹出发,自主搭建循环工程框架,编排智能体自动领取和执行任务,整个过程无需人工干预,连续运行约16天后,独立交付了一个真实可用的自进化智能体框架项目。整个开发过程代码与流程完全开源至GitHub,供全球开发者查阅。这一突破意味着大模型正在从代码辅助工具进化为具备系统级规划能力的智能体引擎,为软件工程领域带来范式级变革。

技术架构与推理效率优化

Qwen3.8采用稀疏MoE(混合专家)架构,总参数量2.4万亿,单次激活参数仅95B,相当于拥有2400名员工的超级工厂精准调度95名骨干员工。架构层面实现了推理效率与模型容量的最优平衡,单次推理速度显著提升。在专业办公场景中,Qwen3.8支持1M Tokens超长上下文,可完整读取200页财报PDF或分析超100小时视频内容。技术评测数据显示,Qwen3.8在科学推理GPQA Diamond评测中取得92.6分,指令遵循IF Bench评测中取得82.8分,视觉推理BabyVision无工具条件下取得82.0分,超出部分主流模型近两倍。在OSWorld-Verified智能体电脑操作能力评测中,Qwen3.8以86.1分位居主流模型首位。阿里巴巴真武M890超节点已成功适配Qwen3.8,通过芯片、云平台与千问大模型的全链路优化,在Agentic推理场景中最多实现1.5倍性能提升。

商业定价与企业级应用前景

Qwen3.8的API已上线千问AI平台,国内定价为每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,国际价格分别为Opus5的40%和24%,实现相近智能更高性价比。同日,阿里巴巴同步推出企业级Agent产品"千问办公"(QwenWork)公测,该产品由QoderWork、MuleRun、悟空三款产品整合而来,是业内首款同时支持桌面端Agent、云端Agent、企业协同Agent的产品。千问办公已初步打通钉钉IM,未来将全面连接企业真实数据库和工作流。典型应用场景包括:20人规模律师事务所资深律师通过多次交互完成首份并购尽调报告后,可将全过程一键沉淀为"组织级Skill"向全团队共享;篮球数据分析团队利用Qwen3.8在数十分钟内精准拆解160小时比赛录像中的8400多个攻防回合,一次性输出球员战术画像和教练报告。千问系列累计下载量超过10亿次,在全球最大AI开源社区Hugging Face排名榜首。预计下周开源Qwen3.8-Max和Qwen3.8-27B,开源生态将进一步扩大。

打开网易新闻 查看精彩图片

【信源】界面新闻 | 阿里Qwen3.8正式发布,总参数量2.4万亿 | 2026-08-03

信源】科技日报 | 阿里正式发布Qwen3.8,千问办公开启公测 | 2026-08-03

【信源】杭州网 | 阿里发布新一代基座大模型Qwen3.8,预计下周开源最大尺寸版本 | 2026-08-04