过去你听到的"AI 笔记本",多是靠一颗NPU跑点翻译、降噪、抠图这类小活,几十的TOPS的算力,撑不起真正的本地大模型,复杂任务还得把数据传回云端。
IFA 2026这次不一样,核心突破只有一个词:统一内存。
什么是统一内存?传统电脑里,CPU用系统内存(比如 32GB),独显用自带的显存(比如 8GB),大模型参数必须全部塞进显存才能跑。
百亿、千亿参数的模型动辄要上百GB,普通显卡根本装不下。而"统一内存"让 CPU、显卡、NPU 共用同一块超大内存,显卡可以直接从这块池子里划走一大块当显存用。问题从"显存放不下"变成了"内存够不够大"——只要内存堆到 128GB、192GB,大模型就被装进去了。
两个词我们顺便了解下:
FP4 精度:厂商说的"1 PFLOPS 算力""千亿参数",多半是4-bit量化(FP4)下的数字。模型降到4-bit会损失一点精度,但体积能压到原来的四分之一,所以"千亿参数"是量化后的结果,不是全精度原版。
带宽(GB/s):参数装进去了,还得读得动。内存带宽决定"吐字速度"。这次机器普遍 273GB/s 上下,和数据中心动辄几TB/s的 H100不在一个量级,所以能跑≠跑得快。
一、接下来我们来看看四款主角
(一)联想 Yoga Pro 9n(国内型号 YOGA Pro 15 Spark),走英伟达路线的"创作本"
这是四款里唯一用英伟达方案的,搭载 NVIDIA RTX Spark 平台。
1、平台:NVIDIA RTX Spark(20 核 Grace ARM CPU + 6144 CUDA Blackwell GPU,NVLink-C2C 封装)
2、AI 算力:最高 1 PFLOPS(FP4 精度)
3、内存:最高 128GB LPDDR5X-9400 统一内存
4、屏幕:15.3″ OLED,2560×1600分辨率,48–165Hz刷新率,1100nit HDR,100% sRGB + 100% DCI-P3,ΔE<0.5
5、机身/电池:铝 347×242×16.7mm,1.65kg,80W TDP,92.5Wh电池 + 140W 充电
6、存储/接口:双 M.2 2242(PCIe4 512G/1T + PCIe5 最高 2T);2×USB4 40G、2×USB-A 10G、HDMI2.1、UHS-II SD;Wi-Fi 7
这台机的卖点很清晰,屏好、轻、还能本地跑大模型。100% P3 + 1100nit + ΔE<0.5 的 OLED,对调色、设计是专业级;1.65kg 在"能跑千亿模型"的机器里算轻薄。
但注意三点:
① RTX Spark 是 ARM 架构的 Grace CPU,不是x86,部分Windows软件兼容性要打问号;
② 它强调CUDA生态,对开发者友好,对普通用户意义有限;
③ 价格没公布,按配置大概率是几万元的"旗舰玩具"。
同台还发布了 Yoga 9n 2-in-1(16″ 翻转本,最高 64GB),定位创作者副线。
(二)联想 ThinkCentre X Ultra(国内 X Tiny), 1.6L 的"商用 AI 迷你主机"
它不是笔记本,是台式迷你主机,而且它是 AMD 路线里最规范的一台。
1、芯片:AMD Ryzen AI Max+ PRO 495(16C/32T Zen5,最高 5.2GHz)
2、显卡:Radeon 8065S 核显(40 CU),最高 96GB 划为显存
3、内存:最高 128GB LPDDR5x-8533(板载)
4、NPU/总算力:55 TOPS NPU/最高 131 TOPS
5、集群:最多4台互联,512GB统一内存+524 TOPS
6、机身:1.6L,183×183×51mm,2kg,TÜV超低噪
7、接口:2×雷电4 40G、2×USB-C 10G、2×USB-A 10G、DP2.1、HDMI2.1、10Gb 网口;Wi-Fi 7
8、价格/上市:2026年11月,起售 $3,699(约 2.6万人民币)
这台机的核心看点有两个。
第一,1.6L 体积塞进 128GB 统一内存,还能四台组网跑更大模型,对企业和科研是刚需,数据不出本地,合规、低延迟。
第二,它用的芯片原生支持192GB,联想主动砍到了128GB(这点后面和极摩客对比会重点说)。
对消费者而言,$3699只是起售价,四台集群凑 512GB 要接近1.5万美元,普通人根本用不上。
它也不是"买回家打游戏"的机器,核显8065S性能接近RTX 4060 Laptop到4070 Laptop之间,跑大模型够、跑3A游戏一般。
(三)AMD Ryzen AI Max PRO 400 系列解析
写到这里,有必要先来看看AMD Ryzen AI Max PRO 400这个系列。
联想 X Ultra和接下来要看的极摩客,都用的是AMD新芯片。它本质是上代 Strix Halo 的刷新版,最大升级就是内存上限从 128GB 拉到 192GB。
三款都是 Zen5 + RDNA 3.5 + XDNA2 NPU,架构没革命,提升主要在内存。
192GB 里最高能划160GB 当显存:而300B参数模型在FP4下大约要 150GB,所以"本地跑 3000亿参数"的说法才成立(官方称上限约3000亿,前提是足够激进的量化)。
TDP 45–120W可配,2026 Q3上市,首批OEM是联想、惠普、华硕。对消费者来说,这颗芯片的意义是:明年会看到更多"大内存小主机"上市,价格会慢慢下探。
亮点:内存拉到192GB是这一代最大升级,明年中端大内存本将直接受益;对当下买家而言,它更像"未来三年的技术预告"。
(四)极摩客 EVO-X5 Pro,把芯片"给满血"的智能体 PC
极摩客(GMKtec)这台拿了 IFA 2026 最佳创新奖,定位"Agentic PC"(智能体 PC)。
1、芯片:AMD Ryzen AI Max+ PRO 495(16C/32T,最高 5.2GHz)
2、内存:192GB LPDDR5X-8533 满血统一内存(带宽 273GB/s),最高 160GB 划为 VRAM
3、显卡/NPU:Radeon 8065S(40 CU)+ XDNA2 NPU 55 TOPS
4、能力:完全离线运行 300B 参数 LLM
5、接口/散热:正面 2×USB4、背面 2×USB4 v2 + 双万兆网口、eGPU、8K 输出;均热板+三风扇;F-MODE 键切 3 档 TDP
6、安全:AMD DASH 远程管理、dTPM 2.0、24/7 运行认证
它和联想 X Ultra是同款芯片,但联想主动砍到 128GB,极摩客直接给满血 192GB,所以它能"完全离线跑300B",联想单机只能跑更小的模型(四台组网才补上)。
代价是极摩客作为二线品牌,价格没公布、售后网络弱,买它赌的是性价比和极客情怀。另外它的卖点不止参数:双万兆网口、eGPU、24/7 运行认证,明显冲着企业/实验室去的,不是家用娱乐机。
亮点/雷点:满血192GB最香、拿奖、价格有望最低;雷点是二线品牌赌售后、定价未公布,更适合极客和企业采购盯防。
二、补充几个技术细节
1、"TOPS"不等于你感知到的速度。厂商最爱标131 TOPS、55 TOPS,但这只是算力峰值。
真正决定你打字时"吐字快不快"的是内存带宽。这次机器普遍 273GB/s 上下。打个比方:TOPS 像工厂的工人数量,带宽像工厂门口的公路宽度。工人再多,原料(模型参数)运不进来也白搭。这也解释了为什么这类机器"能跑300B"但生成速度远不如云端 H100,后者的带宽是其十几倍。
2、"能跑"的前提是量化。300B参数的全精度模型要上千GB显存,根本装不下。
厂商说的"本地跑 300B"指的是4-bit(FP4/INT4)量化版,体积压到约 150GB,刚好塞进 160GB 可分配显存。代价是输出质量比原版略低,但日常对话、摘要、代码辅助够用。所以"千亿模型"≠"满血原版",这是个必须说清的前提。
3、为什么192GB内存里只能划160GB当显存? 因为 CPU、系统、后台程序也要占内存,不能全给显卡。160GB 是给GPU 的"上限额度",剩下32GB留给系统运转。这也是为什么联想 X Ultra砍到128GB后,单机更难跑满 300B,它只剩约96GB能给显卡。
4、ARM架构的隐藏门槛。只有 Yoga Pro 9n走英伟达RTX Spark 路线,其Grace CPU是ARM架构,不是我们熟悉的x86。好处是能效高,坏处是部分老软件、驱动、游戏可能要专门移植才能跑。
总结底层逻辑:这一波"本地跑大模型"的本质,不是算力突然飞跃,而是把内存堆大到能装下模型+用统一内存绕开了显存墙。
三、总结
对普通消费者:噱头大于实用,现在是"战未来",目标用户根本不是你我家用。
而"本地跑千亿模型"真正有用的是政务、科研、金融、医疗这类数据不能出本地的合规场景,以及需要低延迟的企业智能体。
但技术下放值得期待。这一代把"统一内存+大容量"打成了旗舰标配,明年32GB、甚至64GB内存的本子会越来越多,价格会下探。现在买笔记本,别为"能跑本地大模型"多花冤枉钱,但可以把"大内存"当成未来三五年的保值项。
如果就是想尝鲜:极摩客满血192GB最香但要赌售后和定价;联想 X Ultra规范、能组网,但贵且砍了内存;Yoga Pro 9n 屏好轻薄、走 CUDA 生态,等价格公布再看。
三台我都建议等真实评测和定价落地再决定,IFA 发布到上市还有窗口期,别急着当首批小白鼠。
热门跟贴