周三盘中的一笔11%涨幅,把Cerebras Systems推到了台前。直接推动力是一则简短合作公告:AMD和这家专注晶圆级芯片的公司正式结成技术同盟,共同研发AI推理解决方案。
这项合作的核心逻辑是把两家最特立独行的硬件拼在一起。AMD一侧拿出的是刚发布的Helios机架级方案,定位为“超高吞吐量引擎”,专门对付提示处理、长上下文窗口这类吃算力的重活。Cerebras一侧则掏出看家本领——晶圆级引擎,那块搭载了全球已知最大AI芯片的加速卡,负责超低延迟的token生成。
打开网易新闻 查看精彩图片
整条推理流水线被设计成一套系统:用户请求先进AMD Helios做初加工,再切到Cerebras完成毫秒级的最终输出。Cerebras计划首批部署在自己数据中心里,并预计在2026年下半年通过Cerebras Cloud先跑起来,之后再逐步向外开放。
Cerebras首席执行官Andrew Feldman在介绍客户时丝毫不掩饰底气:“我们构建着世界上最大、最快的芯片。”他把这波合作看作AI从“新玩具”变成“刚需”后的必然提速。按他的说法,当AI成了必需品,用户对速度的耐心会极速下降,而超低延迟的推理正好是Cerebras扩大版图的切口,用他的原话就是“这真是太了不起了”。
这一组合拳的卖点很直白:一边用AMD堆高吞吐上限,一边用Cerebras压死延迟的下限。在模型参数动辄千亿、上下文窗口越拉越长的趋势下,这种异构互补确实打到了推理部署的痛点上。至于明年这个时候能不能跑出实验室级别的指标,就要看两家工程团队接下来的落地节奏了。
热门跟贴