打开网易新闻 查看精彩图片

2026年4月8日, SambaNova今日宣布与英特尔达成新一阶段合作协议,推出一款异构硬件解决方案。该方案将用于预填充(Prefill)的图形处理器(GPU)、兼作主机与“行动”CPU的英特尔Xeon® 6处理器,以及用于解码(Decode)的SambaNova可重构数据流单元(RDU)三者有机结合,为最具挑战性的Agentic AI应用提供高端推理服务。

小编注:SambaNova成立于2017年,总部位于加利福尼亚州圣何塞。该公司提供芯片、系统和云服务等,是一代AI基础设施提供商,致力于为全球企业、NeoCloud、AI实验室和服务提供商以及AI项目提供高效的AI推理,部署性能卓越的模型,降低总拥有成本。

打开网易新闻 查看精彩图片

目前,Agentic AI已从演示阶段迈入实际生产部署。编码代理能够编译并运行代码、调用工具与API、访问数据库并协调复杂工作流,所有这些操作均依赖于快速、低延迟的大模型推理。在此过程中,GPU-only架构的局限性日益凸显:GPU虽擅长处理预填充阶段,但CPU及专用推理加速器已成为决定真实世界Agentic工作负载执行速度、可扩展性及生产优化效率的关键因素。

在此背景下,SambaNova与英特尔通过联合研发发现,最优方案为:以GPU启动任务,由英特尔Xeon® 6处理器执行核心工作,再由SambaNova RDU快速完成解码,从而显著提升整体效率。该方案以英特尔Xeon 6处理器和SambaNova RDU为核心架构。

打开网易新闻 查看精彩图片

SN50 RDU专为重塑推理的“tokenomics”(令牌经济学)而设计,能够为大型语言模型提供高吞吐量、低延迟的解码能力;而Xeon® 6处理器则凭借卓越的内存带宽、丰富的PCIe通道密度以及片上加速器,为整个系统提供强大支撑。

在新架构中,GPU负责高度并行的预填充阶段,高效地将长提示转换为键值缓存。SambaNova RDU与Xeon® 6协同工作,作为专用的高吞吐量、低延迟解码加速层,确保CPU完成任务编排后,快速高效地生成输出token。Xeon 6处理器担任主机CPU和系统控制,负责Agentic任务协调、工作负载分配、工具与API执行以及系统级行为控制,同时作为“行动”CPU,承担代码编译、执行及结果验证等职责。

打开网易新闻 查看精彩图片

根据SambaNova的测试数据,Xeon 6处理器在LLVM编译时间上比基于Arm的服务器CPU快50%以上,在向量数据库性能上比现有x86竞品快高达70%。这些性能提升显著加速了端到端的编码代理工作流,帮助开发者更快地将创意转化为可投入生产的智能代理。

综上所述,此次公告标志着双方从合作伙伴关系迈向大规模商业部署,彰显了对技术的坚定信心,并为企业、服务提供商及全球云平台提供了强大且具有竞争力的解决方案。据悉,该设计将于2026年下半年向企业、云服务提供商及主权AI项目正式开放,帮助其在大规模场景下高效运行编码代理及其他Agentic工作负载。

小编将在第一时间分享更多相关最新动态和爆料,敬请关注。