打开网易新闻 查看精彩图片

据知情人士透露,其算力供应商或来自海光、华为与摩尔线程,智谱官方没有评论这一信息。

出品丨自主可控新鲜事

本文内容来源于第一财经、晚点

正文共383,建议阅读时间1分钟

8月27日, 智谱 官方确认,刚刚上线的GLM-5系列首个原生多模态模型GLM-5.3-Flash,全部线上流量由10万张国产芯片承载。正式发布前,该模型以匿名身份在 OpenRouter 、OpenCode两大海外平台测试,token调用量高达62T,这些请求流量全部由国产芯片提供算力支持。据知情人士透露,其算力供应商或来自海光、摩尔线程等,智谱官方没有评论这一信息。

智谱在技术文档中表示,其集群“硬件效率及单位 token 成本已经达到了与主流英伟达GPU相当的水平”,但没有明确具体型号。GLM-5.3 Flash 拥有 300B 参数规模, 参数量约为 GLM-5.3 的 40%,与 DeepSeek V4 Flash 几乎持平。与同代小尺寸模型往往蒸馏自大模型不同,GLM-5.3 Flash 采用与 GLM-5.3 不同的架构设计,具有原生多模态能力,支持图像视频输入,这也是智谱战略聚焦 coding 以来第一次推出具有多模态能力的新模型。

免责声明:本文系网络转载,版权归原作者所有。但因转载众多,或无法确认真正原始作者,故仅标明转载来源,如涉及作品版权问题,请与我们联系,我们将在第一时间协商版权问题或删除内容!内容为作者个人观点,并不代表本公众号赞同其观点和对其真实性负责。

点击下方标题,洞悉信创产业发展