为什么AMD要在自己的AI峰会上反复强调“推理”?苏姿丰给出的数字很直接:今年,60%的计算资源已经花在推理上,而不是训练。在一个还在疯狂堆算力预训练的时代,这个比例意味着整个AI产业的价值重心正在悄悄偏移——训练的红利还没吃完,推理的战争已经打响。
一、推理首次超越训练,算力结构彻底变了
苏姿丰直截了当地宣布:“今年是推理超越训练的第一个年头。”算力需求还在每年翻5倍地涨,模型越变越专,智能体AI(Agentic AI)又把需求推到一个更不可预测的轨道上。你给AI一个问题,它就会不停干下去,直到问题解决——这背后,不是一次性的训练开销,而是持续不间断的推理消耗。对芯片供应商来说,训练只是卖一波,推理是卖一辈子。AMD押的正是这个逻辑。
二、1.4万亿美元的棋盘,AMD想当下棋的人
苏姿丰甩出一个预期:到2030年,AI加速器市场将膨胀到1.4万亿美元,相当于今天整个半导体市场的大小。她甚至承认,AMD自己当初都低估了CPU市场的增速——仅CPU这块,2030年也将扩张到2200亿美元。服务器CPU收入份额已经占到46%的AMD,显然不满足只做CPU的生意。公司三大支柱战略——计算领导力、开放平台、无处不在的AI——背后全是同一个信号:算力的每一个环节,AMD都要吃。
三、正面硬刚NVIDIA,15%的性能优势是真是假?
峰会最刺激的环节来了:AMD发布Instinct MI455X加速器,直接拉出NVIDIA“Vera Rubin”对标。基于台积电3nm和2nm工艺、拥有3200亿晶体管、432GB HBM4内存的这颗芯片,官方宣称推理性能比对手高出15%,带宽更高。Helios机架则集成了GPU、CPU、网络、冷板、供电和系统管理,大幅降低部署复杂度。全生产版本已经就绪,第四季度发货,首批客户就是头部AI实验室。AMD这次没有拿PPT讲故事,而是直接把节奏压到了出货这一环。
四、客户已就位:Anthropic和OpenAI一起站台
峰会上,苏姿丰把Anthropic联合创始人Tom Brown和OpenAI基础设施主管Sachin Katti先后请上台。Anthropic计划部署高达2GW的Helios集群,Tom Brown直呼“这台机器让人惊叹”,并透露Claude团队已经投入更多硬件工程资源,与AMD的合作将是“多年的开始”。OpenAI这边则更加急切,Katti一句“我们等不及要它了”几乎就是在催单。对AMD来说,能有两大AI玩家同时背书,等于把“我们不靠NVIDIA也能跑大模型”这句话彻底做实。
五、CPU也卷进智能体时代:Venice核心堆到离谱
苏姿丰展示的新一代EPYC “Venice” CPU,同样冲着智能体AI而来:2nm工艺、3020亿晶体管、单插槽最高256核512线程。Venice不是一个芯片,而是一个家族——高频版Venice-HF给到128核、最高5GHz;Venice Dense则堆到256核,后面还有更高效的“Verano”和3D V-Cache的Venice-X在候着。一面是AI加速器抢跑推理,一面是CPU疯狂堆核,AMD想要的,是把从模型训练到推理部署的整个计算栈,都用自家硅片填满。
热门跟贴