OpenAI的财务命运正日益被基础设施成本所绑定,这一现实直接催生了其首款定制芯片“OpenAI Jalapeño”的诞生。这款由OpenAI与博通(Broadcom)联合研发的专用集成电路(ASIC),旨在通过摆脱对第三方硬件的高度依赖,缓解惊人的资本支出压力。
当前的AI算力市场格局中,英伟达在高端处理器上享有约75%的利润率,而OpenAI的盈利空间则显得捉襟见肘。扣除庞大的运营费用后,OpenAI每产生1美元收入仅能保留约33美分利润。随着ChatGPT周活跃用户达到9亿,维持服务器响应的成本去年已高达84亿美元,预计今年将攀升至140亿美元。更为严峻的是,OpenAI已承诺在未来八年内投入约1.4万亿美元用于计算能力建设,这对于一家年营收250亿美元的公司而言,是一场关乎生死的技术赌注。
专为大模型推理打造的“智能处理器”
Jalapeño并非通用AI加速器,而是专门为大型语言模型(LLM)推理任务构建的“智能处理器”。OpenAI提供了基于其模型路线图的核心架构设计,博通则负责硅工程与高性能网络集成,台积电承担物理制造,Celestica负责主板及机架系统组装。
OpenAI硬件项目主管Richard Ho表示,该架构通过最小化数据移动,使实际利用率更接近理论峰值性能。与从传统负载改编的通用加速器不同,Jalapeño专门平衡了计算、内存和网络资源,以解决交互式LLM服务中原生的数据移动瓶颈。此外,平台集成了博通的Tomahawk网络硅片,确保定制处理器能在庞大的集群数据中心环境中高效通信。目前,早期实验室样品已在目标频率和功耗下成功运行包括未发布的GPT-5.3-Codex-Spark在内的前沿工作负载。
垂直整合:构建基础设施飞轮
推出自有芯片标志着OpenAI从纯软件层向垂直整合基础设施公司的转型。这种全栈策略覆盖了芯片架构、软件内核、内存系统、网络调度及应用层。正如苹果将专有硬件与iOS深度耦合,OpenAI现在可以围绕其内部确切的模型路线图优化基础设施。
这种整合正在形成一个运营飞轮:基础设施效率提升降低了训练和服务成本,更低廉的成本带来更优质、响应更快的产品,进而推动用户量和收入增长,收益再被重新投入下一代定制基础设施的研发。
9个月极速流片,弥补后发劣势
在专有硬件领域,OpenAI面临谷歌、亚马逊等巨头近十年的先发优势。谷歌TPU已控制全球约四分之一的非英伟达AI算力,亚马逊定制芯片出货量超百万颗,Meta和微软也在持续扩张自有设施。
为弥补时间差距,OpenAI加速了开发进程。Jalapeño从空白设计到制造流片仅用时九个月。工程团队利用OpenAI自身的语言模型自动化和优化部分硬件设计流程,创造了独特的反馈循环:服务于用户的模型,正被用于构建运行未来迭代版本的物理基础设施。
OpenAI总裁兼联合创始人Greg Brockman指出,Jalapeño是长期全栈基础设施战略的一部分,旨在通过自行设计更多技术栈,使计算资源更加充裕,从而更高效地提供智能服务。首批硬件部署定于2026年底开始。博通首席执行官陈福阳确认,随着微软等合作伙伴的加入, rollout规模将扩大,以准备千兆瓦级数据中心的集成。
【星途科讯 图文丨Patrick 首发于ZAKER科技,转载请注明出处】
热门跟贴