来源:市场资讯
(来源:网易智能)
8月26日消息,阿里发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,Transformer参数125B,每次仅激活6B,性能超越Claude Opus4.6、接近Opus4.8。
据介绍,Qwen3.8-Flash训练成本较Qwen3.7-Plus下降近90%,仅使用约九分之一的资源即可完成训练。推理价格方面,每百万Tokens输入低至1元、输出3元,约为Claude Opus4.6的3%,最低为DeepSeek-V4-Flash价格的1/3。
性能方面,在SWE-bench Pro智能体编程评测中,Qwen3.8-Flash领先Opus4.6达9.1分;在JobBench专业工作任务评测中领先Opus4.6近20分;AndroidWorld移动端智能体评测高出22.5分,MathVision视觉数学推理高出25.1分,具身智能ERQA任务领先31.5分。
架构方面,Qwen3.8-Flash引入QSA稀疏注意力机制、Gated Residual方法以及51B的N-gram Embedding参数。其中,在高缓存命中的1M Tokens长上下文场景下,QSA可实现8倍以上提速。
目前,Qwen3.8-Flash已首发上线“千问办公”,其标准模式内置该模型,可完成95%的日常办公任务。开发者和企业也可通过千问AI平台调用API。
据了解,该Next架构将作为下一代Qwen4模型的雏形,Qwen3.8-Flash-Next模型权重已在Hugging Face、魔搭社区开源。截至目前,Qwen3.8系列已开源Qwen3.8-Max、Qwen3.8-27B及Qwen3.8-Flash三个尺寸,系列总参数量达2.4T;Qwen模型全球下载量已突破30亿次,衍生模型超过30万个。(定西)
热门跟贴