阿里云近日发布Qwen3.8-Flash,一款多模态MoE(混合专家)模型,作为Qwen4架构的早期预览版本,现已开放权重下载。

该模型总参数量达125B,但得益于MoE架构,每个token仅激活6B参数,推理效率显著提升。据官方数据,其训练成本仅为前代Qwen3.7-Plus的1/9,而综合性能全面超越后者。

打开网易新闻 查看精彩图片

定价与上下文能力

API定价方面,输入每百万token收费0.16美元,输出每百万token收费0.47美元。模型原生支持262K上下文窗口,并可扩展至1M,为长文本处理场景留足空间。

作为Qwen4架构的先行预览,Qwen3.8-Flash的发布意味着阿里云在多模态与高效推理路径上的又一次提速。