8月26号那天,我正泡着茶刷推送,突然弹出一连串“M6”“M5 Ultra”“1.2TB/s”——不是显卡发布会,是苹果把Mac mini和Mac Studio全换血了。没提Vision Pro,也没讲iOS 18新图标,所有PPT页面都在说一件事:这代芯片,就是为AI推理抠出来的。你要是真想把Qwen2-70B或者Phi-3-vision塞进自己书桌角落那台小盒子,光看“能装下”远远不够,得算它喘不喘得上气。

打开网易新闻 查看精彩图片

Mac Studio M5 Ultra那块512GB统一内存,要等到10月下旬才发货。可朋友圈里已经有人下单了96GB起步的版本,配1TB固态,四万六千九百九十九,付款时手没抖,但收到发票那一刻盯着“M5 Ultra(双芯quad-die)”这行小字看了三分钟——它带宽1.2TB/s,是M6 Mac mini 16GB版的近八倍,可这数字真能换来你每天多生成200条稳定回复?还是只在跑通第一个235B模型时让你拍了张照发朋友圈?

我上个月拿M6 Mac mini 24GB试过CodeLlama-32B-Q4_K_M,开VS Code+Ollama+本地向量库,再加载一个PDF解析服务,系统直接开始杀后台。不是卡,是内存告急的温柔提醒:你还有1.8GB可用。而隔壁朋友用M5 Max Studio 64GB跑同样模型,上下文从4K拉到32K,token生成速度肉眼可见地从“等它嚼完”变成“它刚说完我就想好下一句”。差在哪?带宽从170GB/s跳到614GB/s,重量没变,但数据跑得更快了——就像把乡间水泥路换成沪宁高速,车还是那辆车。

Mac mini M5 Pro 48GB定制价12999起,但选满64GB后总价逼近22000,这时候再看Mac Studio M5 Max 36GB起售19999,就有点微妙了。它多出来的不止是GPU核数和带宽,还有雷雳5、双万兆网口、甚至支持外接两台Pro Display XDR——你买的是内存?还是未来三年不用换主机的底气?

6999元的M6 Mac mini 16GB+256GB,现在蹲直播间还能抢到。它确实能跑Phi-3、Gemma-2B、TinyLlama,聊天气、写周报、给娃编童话都行。但你要是真把它当主力AI工作站……对吧?打开Chrome占2.3GB,Docker Desktop一开又吞1.1GB,等你把model.gguf拖进命令行,终端回车那一刻,风扇声就开始讲故事了。

有人问我:“70B到底能不能在128GB Mac Studio上日常用?”我试过Qwen2-70B-Q4_K_M,8K上下文,开浏览器查资料+IDE写代码+模型实时补全,三件事并行,机器温温的,风扇转速没破3200rpm。但你要切到128K上下文,或者同时起两个RAG pipeline,内存占用立刻冲到93%,系统开始偷偷压缩页面。这时候你就懂了:参数不是数字游戏,是物理世界的重量、热量和时间。

苹果没说谎。M6适合尝鲜,M5 Pro适合认真干活,M5 Max是让中型模型呼吸自如的办公室,M5 Ultra……大概率是你未来三年不会拆封第二台Mac的理由。只不过,当你在Apple官网勾选“512GB统一内存”那一瞬,到底买的是算力,还是某种对AI时代的笃定?