单芯片性能为上一代M890的3倍,面向万亿参数大模型训推与长上下文Agent推理
9月22日,2026云栖大会主论坛上,阿里巴巴旗下平头哥半导体发布新一代训推一体AI芯片——真武V900。按照公布信息,该芯片计划于2027年第一季度正式量产销售。
从定位看,真武V900属于真武系列新一代旗舰AI加速芯片,重点面向万亿、十万亿参数超大模型训推,以及长上下文Agent推理等场景。
核心参数:显存、互联、精度同步提升
先看几个关键指标。
算力方面,真武V900单芯片性能为上一代真武M890的3倍,主要面向超大模型训练与推理需求。
显存方面,真武V900配备216GB大容量显存。对大模型来说,显存直接关系到上下文能否常驻、推理时是否需要频繁换入换出。216GB的规格,显然是为了缓解长上下文场景下的显存压力。
片间互联方面,真武V900带宽达到1200GB/s,搭配自研ICN互联体系,单集群最高可扩展至50万卡。这意味着它不只强调单卡性能,也在强调大规模集群扩展能力。
精度支持上,真武V900原生支持FP8、FP4超低精度计算。按照官方说法,精度降低后,单位电能产出Token数可接近翻倍,兼顾高精度训练、超低精度推理全场景,并适配Agent智能体负载。
架构与定位:算、存、网全栈自研
真武V900采用平头哥自研并行计算架构,配套自研ICN Switch互联芯片和T-Head SAIL软件栈,形成算、存、网全栈自研体系。
这套组合主要服务超大规模大模型集群训练、长上下文Agent推理等场景,同时支撑阿里千问等大模型迭代与智算集群建设。
简单理解,平头哥这次发布的不是一颗孤立芯片,而是围绕大模型集群训练和推理,把计算、存储、互联、软件栈一起打包推进。对超大规模AI基础设施来说,单卡强还不够,集群效率、互联带宽、软件适配同样关键。
迭代路线:真武系列继续推进
从已公布信息看,真武系列迭代节奏比较清晰:
- 真武810E:96GB显存;
- 真武M890:144GB显存,2026年5月发布;
- 真武V900:216GB显存,2027年Q1量产;
- 后续规划:真武J900预计2028年Q3推出。
从96GB到144GB,再到216GB,显存容量持续上探。背后对应的是大模型参数规模扩大、上下文变长、Agent任务复杂化带来的现实需求。
看点与待验证:优势明确,量产和生态仍需观察
从参数和定位看,真武V900的优势比较清楚:国产高显存、高互联带宽训推一体芯片,集群扩展能力强,软硬件栈自主可控,并且聚焦Agent时代长上下文推理需求。
但也要看到,它距离正式量产还有一段时间。生态成熟度、实际集群能效、软件适配规模,仍需要后续实测和落地案例验证。芯片行业从来不只是看发布会参数,还要看量产交付、客户迁移成本、开发者生态和长期稳定性。
综合来看,真武V900的发布,说明国产AI芯片正在向更高显存、更高互联带宽、训推一体和超大规模集群方向继续推进。它能否在2027年量产后交出实际成绩,值得继续关注。
(本文基于公开信息整理,不构成投资建议。)
热门跟贴