英伟达的发布会还没开,AMD先把牌摊在了桌上。业界普遍传闻英伟达将在10月7日联合微软推出RTX Spark,AMD显然不打算等。这家公司不仅提前亮出了全新的Ryzen AI Max+ Pro 495,还顺手把自己调侃成了"Agentic Micro Devices since 2025"。
这是一次典型的抢跑卡位。但抛开时间点上的小心思,这颗芯片本身的规格确实值得单独拿出来说:16个桌面级Zen 5核心,加上最高192GB统一内存。AMD造出的是一件x86架构的蛮力武器,目标直指云AI订阅费、英伟达,顺带也让苹果感到一丝压力。
192GB这个数字意味着什么
要理解AMD为什么着急,得先看英伟达想在RTX Spark上做成什么。英伟达的思路是把基于Arm架构的计算核心和Blackwell图形核心配在一起,再配上统一系统内存,让本地AI智能体变得触手可及。
这套打法苹果几年前就用Apple Silicon在MacBook Pro上写好了剧本——把CPU和GPU围绕一大池内存融合起来,是应对重负载任务和本地大模型的最优解。苹果搭好了这个沙盒,英伟达想接手,而AMD直接往里面倒了一卡车混凝土。
传统笔记本想在本地跑大模型,内存容量就是那道过不去的坎。Ryzen AI Max+用最直接的方式——堆量——把这道坎填平了:
- 192GB共享内存池:CPU和GPU可以共用这192GB内存,数据传输速度达到每秒85亿次。
- 160GB可调空间:通过名为可变显存(VGM)的功能,用户最多可以把其中160GB直接划给图形处理使用。
- 规模对比:单台笔记本可用的显存,比四张桌面级RTX 4090捆在一起还多。这意味着千亿参数级别的AI模型可以完全在设备端离线运行。
离线这一点很关键。本地AI才是未来,而不是ChatGPT或Gemini这类云端模型——现在已经有真实案例可以证明这个判断。
把云服务商请出局
科技爱好者早就听腻了"AI"被贴到每一件基础表格运算上,所以AMD请来了拿过艾美奖的制作公司LightSail VR,来展示本地智能体的经济账。
这家VR工作室最近拍摄了一场Sabrina Carpenter的演唱会,日常处理的是好莱坞级别的16K、90帧立体3D视频。随着多个项目的客户反馈不断涌入,小团队开始吃不消。
用OpenAI或Anthropic这类云端模型来协调工作,有两个走不通的地方:
- 好莱坞严格的保密协议:机密剧本、片段或项目排期不能离开工作室半步。
- 云端计费表:运行需要不断重建文档索引、调整制作时间线的自主智能体,每月会烧掉数千美元的云端AI token费用。
于是LightSail VR在一台带统一内存的AMD Ryzen AI Max台式机上,搭建了内部的"制作协调员"智能体,直接跑在团队的Slack里。它能更新排期、重写表格,在剪辑时间线变动时自动提醒团队。
回报相当可观:工作室现在能同时管理六到九个项目,而过去需要投入的精力只够应付两个,数据不出门,云端AI账单也是零。
对普通用户意味着两件事
你大概率不是在为好莱坞工作室做16K立体视频。那为什么要在意一颗192GB的笔记本处理器?因为整个科技行业正在试图把你困进一张AI订阅费的网里。
现在用生成式AI智能体整理生活或者起草邮件,都要付一笔不便宜的月费。而通过造出一颗带超大统一内存的笔记本芯片,AMD相当于把云服务器塞进了背包。这带来两个消费者层面的胜利:
- 订阅税的终结:硬件买一次,之后你的自主数字助理可以24小时整理硬盘、起草邮件、分析大型表格,不再产生一分钱云端AI费用。
- 绝对的隐私:不必再把报税单、机密工作文件或个人日程上传到加州某台服务器上,才能获得AI协助。这些庞大的模型可以直接装进AI Max的内存池,完全本地、离线运行。
这不只是算力问题,而是一条从即将到来的云订阅时代逃生的硬件出口。
x86对Arm的那道护城河
这就引出了AMD与英伟达(某种程度上也包括苹果)之间的核心战场。
RTX Spark押注的是Arm架构。Arm芯片的能效表现极其出色——苹果已经证明了很多年——但在Arm上运行传统Windows应用,需要经过翻译层。微软的Prism模拟已经进步很大,但翻译层依然会带来能效损耗、偶发的驱动问题和老硬件的兼容性麻烦。
AMD的路线则不需要这层翻译。x86的兼容性本身就是它的护城河,而192GB统一内存则是在这条护城河上加了一道闸门。