苹果 10 月底要开卖一个 512GB 内存的 Mac Studio 选项。
同一件事的另一面很少被一起说:今年这七个月,苹果一直在往下砍内存配置。512GB 先被砍掉,然后是 256GB、128GB、64GB,一个接一个下架。
这不是苹果变抠了。是内存涨到它自己扛不住,只能动手改产品线。
苹果先砍掉 512GB,又装回来了
时间线很清楚,每一步都有官方页面或发布会可查。
时间
发生了什么
2026-03
Mac Studio 的 512GB 内存选项被移除,上限降到 256GB
2026-05
继续下架:M3 Ultra 的 256GB、M4 Max 的 128GB、Mac mini M4 Pro 的 64GB
2026-08-25
发布 M5 Max / M5 Ultra Mac Studio,512GB 装回来了
2026-09-22
新 Mac Studio 开售,但 512GB 版本要等到 10 月底
苹果中国官网现在的写法是:内存可选 36GB 到 256GB,然后跟一句小字,512GB 配置将于 10 月末推出。
一个配置被砍掉五个月又装回来,说明苹果当时砍它不是产品决策,是没货。
同一时间,入门 Mac 涨了 300 美元
真正影响到大多数人的不是 512GB,是下面这张表。
配置
2024-10 首发
2026-06
现在(M6 世代)
16GB / 256GB
$599
$799
$899
16GB / 512GB
$799
$999
$1,199
24GB / 512GB(Pro)
$1,399
$1,599
$1,699
16GB 起步的 Mac mini,从 $599 涨到 $899,涨了 50%。中间涨过两次:6 月一次涨 200,8 月新机型发布又涨 100。
这件事的性质值得说清楚。苹果不是因为出了新品才涨价的,是同一条产品线在半年内被加了两次价。上一次 Mac mini 换代还维持原价,这一次没有。
涨价的源头:一个季度 90%
内存合约价的上涨速度,是这轮变化的总开关。
集邦咨询(TrendForce)把 2026 年第一季度的通用 DRAM 合约价预测,从原先的季增 55% 到 60%,上修到了 90% 到 95%。分开看更惊人:PC 用的 DRAM 涨超 100%,创下季度涨幅的历史纪录;服务器 DRAM 涨约 90%;手机用的 LPDDR4X 和 LPDDR5X 也涨约 90%。NAND 闪存同步从 33% 到 38% 上修到 55% 到 60%,企业级 SSD 涨 53% 到 58%。
传导到零售端是这样:32GB 的 DDR5 台式机内存条,2025 年 9 月大约 800 元,2026 年 3 月电商均价 3800 元,半年涨了约 375%。
三大原厂把先进产能优先给了 HBM,通用 DRAM 的产出被主动压缩。TrendForce 估算,2026 年全球约 22% 到 23% 的 DRAM 晶圆产能被 HBM 消耗掉,AI 服务器一家就吃掉超过 50% 的 DRAM 需求。
所以苹果面对的不是涨价,是缺货。砍配置比加价更能保住交付。
为什么 512GB 又能回来了
因为 M5 Ultra 换了造法。
苹果这次的 M5 Max 本身就是两块硅片拼起来的,M5 Ultra 再把两块 M5 Max 融合,一共是四块硅片封装在一起。这是苹果第一颗四晶圆芯片,用新一代 UltraFusion 互连。
代价是不线性。好处是能堆的容量和带宽上去了:内存带宽 1.2TB/s,是 M3 Ultra 819GB/s 的 1.5 倍;AI 峰值算力最高是 M3 Ultra 的 4.3 倍。
配套的价格也上去了。中国官网 M5 Max 版 ¥19,999 起,M5 Ultra 版 ¥46,999 起,比上一代 M3 Ultra 贵了 1500 美元。512GB 版本苹果还没公布价格。上一代 M3 Ultra 的 512GB 起价是 9,499 美元,按这个量级外推,M5 Ultra 的 512GB 会是两万美元以上的机器。
一个信号比参数更值得注意:苹果开始在 Mac Studio 页面上直接放 LM Studio 的实测数据当卖点,文案里点名 Gemma、Kimi、Mistral,还写了一句话,不需要云端 token。这是苹果官方第一次把 Mac 明确当成不需要按量付费的本地推理机器来卖。
那个 9.8 倍,不是你以为的 9.8 倍
苹果官网给了两组很抓眼的数字:M5 Ultra 的 LLM 提示词处理比 M1 Ultra 快 9.8 倍,M5 Max 比 M1 Max 快 10.7 倍。这些数字来自苹果自己 2026 年 7 月的受控测试,不是第三方基准。
关键在于它测的是哪一段。
提示词处理(prompt processing)是 prefill,也就是模型读你问题的那一段。这一段是计算密集的,苹果新加的神经加速器就是冲它去的。它不代表模型生成回答的速度。
生成速度是另一回事。第三方评测给了同一套提示词下的实测:M2 Ultra Mac Studio 约 18 到 20 tok/s,M5 Max 约 31 tok/s,M5 Ultra 刚过 50 tok/s。
把这几个数字摆一起,结论就清楚了:从 M1 到 M5 的 9.8 倍,是五年的跨度;从上一代到这一代,解码速度的提升大概是 1.5 到 1.7 倍。苹果挑了一个自己赢得最大的口径公布。
我不是说这个数字是假的。是说你在决定要不要为它多付 1500 美元的时候,要知道自己买的是读题快,还是答题快。
你的内存到底能跑什么
下面这张表按权重体积算,前提是模型权重能完整放进内存,不含上下文缓存和系统占用。
内存
典型机型
能跑什么
16GB
Mac mini M6 起步
7B 到 14B 的 4-bit,20B 级 MoE 勉强
24GB
Mac mini 选配
27B 的 4-bit 能跑起来
32GB
Mac mini 上限
27B 的 4-bit 有上下文余量,这是 M6 mini 的天花板
64GB
Mac mini M5 Pro 上限
70B 的 4-bit,或 120B 级 MoE
96GB
Mac Studio M5 Ultra 起步
120B 级 MoE 带上下文余量
128GB
Mac Studio M5 Max 上限
100GB 到 120GB 的稀疏 MoE
256GB
Mac Studio M5 Ultra 选配
235B 级 MoE 的 4-bit
512GB
10 月底开卖
744B 级 MoE 的 4-bit,权重约 372GB
最后一行需要解释。GLM-5.2 是 7440 亿参数的 MoE 模型,官方仓库只提供 BF16 和 FP8 两个版本,分别是约 1488GB 和约 744GB。做 4-bit 量化之后权重约 372GB。512GB 的机器刚好把它整份放进内存。
这也是 512GB 唯一的用处。除非你在跑这一档的模型,否则它对你没有意义。
还有两个选配置时容易漏掉的点。
第一,内存和带宽是绑在一起卖的。M6 Mac mini 的 16GB 配置内存带宽 153GB/s,选到 24GB 或 32GB 之后带宽变成 170GB/s。多花钱买的不只是容量。
第二,最便宜的那台 Mac mini,内存上限只有 32GB。要更大的内存,只能往上买 Mac Studio。
最容易算错的地方:只算权重,不算上下文
大多数人选配置的逻辑是:模型文件 30GB,那我买 32GB 的机器。
这个算法漏了上下文缓存。模型跑的对话越长,KV cache 占的内存越多,而这部分在下载页面上是不写的。
以 gpt-oss 20B 为例,4-bit 量化后权重是 10.8GB。按公开的显存计算口径(权重加 KV cache 加 1GB 运行开销):
上下文长度
总占用
其中 KV cache
8K
12.0GB
约 0.2GB
32K
12.6GB
约 0.8GB
128K(上限)
14.8GB
约 3.0GB
这个模型的 KV 增长算温和的,因为它用了带状注意力,只有部分层需要完整缓存。换成不做这种优化的模型,同样把上下文从 8K 拉到 128K,多出来的占用会翻好几倍。
还有一个系统层面的折扣。我们在自己的 M3 Mac 上量过,Metal 的推荐工作集上限是统一内存的 74%,24GB 的机器对应 17.76GB。也就是说 24GB 的 Mac,真正能交给模型的不到 18GB。
这两条加起来,选配置的正确算法是:权重加够用的上下文缓存,再除以 0.74,看落在哪一档。
该买多大
按手上的机器分四种情况。
手上是 16GB:7B 到 14B 的模型是你的舒适区,20B 级 MoE 勉强能跑。不要指望 27B 以上,那需要 24GB 起步。
手上是 24GB 或 32GB:27B 的 4-bit 是甜点,上下文能开得比较舒服。32GB 是今天能买到的 Mac mini 的最高配。
手上是 64GB:按 70B 的 4-bit 规划,或者 120B 级 MoE。这是当前性价比最高的本地推理档位。
准备买新机:先想清楚你明年想跑多大的模型,因为统一内存焊死在主板上,买到手是多少就是多少,没有后期升级这条路。按现在想跑的模型选,你会提前一年发现自己又不够用了。
至于要不要等 10 月底的 512GB:如果你在跑 744B 这一档的 MoE,值得等,因为之前只有多卡方案能装下它。如果你的模型在 70B 以内,那台机器跟你没关系,它的全部价值就是把你现在能跑的东西跑得稍微快一点。
内存涨价这件事,对你唯一的实际影响是:新机器的入门价涨了 300 美元。你手上那台不会变贵。
热门跟贴