打开网易新闻 查看精彩图片

去年我在一篇文章里写过一句话:在算力这个江湖里,中国人迟早要端出自己的硬菜。 没想到,这道菜来得这么快,而且端上来就是主菜的量级。

7月19日,上海WAIC 2026现场,天数智芯把新一代通用GPU旗舰“天垓300”摆上了台面。这不是实验室里跑个分就收起来的概念品,而是一上来就直接对标、并且超越英伟达Hopper架构的量产级产品。

先别急着被那些参数绕晕,我用大白话把这件事说透。

打开网易新闻 查看精彩图片

GPU这玩意儿,过去十年基本是英伟达的“一言堂”。 尤其是AI大模型爆发之后,Hopper架构的卡贵到离谱,还得排队等货。国内谁想做点像样的AI应用,先得看黄仁勋的脸色。这不是商业问题,这是生存问题。

天垓300这次做了什么?它基于一种叫SIMT的通用计算架构,你可以把它理解成一条更聪明的高速公路,指令和数据的跑法跟英伟达的CUDA思路不同,但最终要解决的是同一个问题:更快、更稳、更省地把大模型跑起来。

打开网易新闻 查看精彩图片

测试数据很直接。在上下文64k场景和MoE(混合专家)推理场景中,天垓300的平均效能比Hopper方案高出10%。别小看这10%,在动辄万卡集群、电费按秒烧的算力中心里,10%的效率差就是真金白银的利润线。更狠的是“首字延迟”,也就是你问大模型一句话,它蹦出第一个字的时间——天垓300降低了约20%。用过ChatGPT的人都知道,那个转圈圈的等待最消磨耐心。延迟砍掉五分之一,相当于把用户体验的“卡脖子”感直接削去了一层。还有Decode阶段的通信延迟,降低约13%,这解决的是多卡协同的堵车问题。

打开网易新闻 查看精彩图片

透过参数看本质,这绝不是一个简单的“跑分超越”故事。

第一层本质:架构自主权的胜利。 SIMT通用计算架构不是照着CUDA抄作业,而是另起一行写了张卷子,还拿了高分。这意味着在Qwen、GLM、Kimi、DeepSeek这些国内主流大模型的适配测试中,天垓300已经跑通了闭环。以前总有人说国产GPU“能用但不好用”,这次天数智芯把“好用”两个字写在了测试报告里。

第二层本质:从“单点突破”迈向了“系统就绪”。 很多芯片发布时风光,落地时踉跄,卡在服务器适配、互联生态、软件栈这些“最后一公里”。但天数智芯明确透露,天垓300已经和国内云厂商、服务器厂商、互联生态及超节点系统完成了深度适配,支持从单机到规模化集群部署。这句话翻译过来就是:货架已经摆好了,客户可以下单了。 这是芯片进入商业正循环的关键信号。

打开网易新闻 查看精彩图片

站在历史长河看这场变局,你会发现一个清晰的脉络:当一项底层技术被少数公司垄断太久,市场自然会孕育出破局者。英伟达的Hopper很强,但它的强也筑起了一道高墙——价格高、供货紧、生态封闭。天垓300的出现,就像在坚实的城墙上轰开了一道口子。它告诉整个行业:算力的定价权,不该只掌握在一家公司手里。

更让我感慨的是时机。2026年,大模型正从“训练军备竞赛”转向“推理大规模落地”。推理需要的是低成本、低延迟、高能效,而这恰恰是天垓300发力的靶心。在MoE推理这类复杂场景下超越Hopper,相当于在对手最擅长的地盘上赢了一局。

打开网易新闻 查看精彩图片

当然,冷静地说,一款芯片从“能用”到“人人都用”,中间还隔着生态建设的长路。但天数智芯这次给出的信号已经足够清晰:中国通用GPU的牌桌上,终于有了一个能和庄家对等叫牌的选手。

算力的游戏规则,正在被重写。而这一次,笔握在我们自己手里。

打开网易新闻 查看精彩图片