前一阵子,各品牌显卡工厂全面封仓、暂停出货,等待8月重新定价,与此同时国内RTX 5090的售价已经近4万元,RTX 5070 Ti国内渠道报价也站上了一万元关口。
显卡越来越贵,已经从消费品变成了理财产品。
但这一次,等等党可能真的能赢,只不过赢法跟所有人想的不太一样:不是等显卡降价,是等独显这一整个品类被替代。
一、内存更大、更省钱、更省电、还不容易坏
别急着反驳,从宏观来看,现在是什么时代?
大模型时代。
现在的个人电脑作为大模型载体,就算搭载独显里最强的5090,跑一个70B参数的模型勉强够用,但120B以上或者同时跑多个模型马上歇菜。
这就是现在独显的短板:算力冗余,却被显存焊死了天花板。
那么怎么办?这就是本文的主角:统一内存电脑。
苹果官网截图
当然有不跑大模型的用户,但兼跑大模型和玩游戏的用户却不少,谁会拒绝合二为一呢?
有人就会说了,统一内存电脑,这我知道啊,动不动就64G,128G内存,但现在的内存堪比黄金,不得贵死?
恰恰相反,它比独显便宜得多。
算一笔账:传统PC的独立显存是GDDR6或GDDR7做的,GDDR7目前每GB大约8到10美元,一块16GB显存光颗粒成本就接近150美元。
而LPDDR5X每GB只有2到2.5美元,128GB统一内存的颗粒成本大约250到320美元。
这么一比较,每GB有效成本直接差出一个数量级,更重要的是,这128GB还能当成显存,它反而是市面上最便宜的显存方案。
尽管整机溢价目前还在,但颗粒成本低是上游趋势,下半年联想惠普宏碁进来卷之后,价格会逐渐下降,当年SSD刚出也贵,现在呢?
其次,CPU,GPU,集成封装的优势会带来功耗的优势。
统一内存把CPU、GPU、内存控制器全部封装在一颗SoC里,信号路径从几十毫米缩短到封装基板上的几个毫米,不用像传统PC那样到处走线。
今年Computex期间,多家海外硬件评测机构的实测显示,苹果M系列芯片以30瓦级别的整机功耗,在大模型推理任务上跑出了传统150瓦独显平台70%到80%的性能,单位功耗产出的token数与传统PC的差距达到了3到5倍。
英伟达官网截图
集成的另一大好处就是低故障率。
英国翻新零售商Hoxton Macs在今年6月发布了一份基于2013年以来维修数据库的报告,搭载M系列芯片的Mac硬件故障率仅为0.9%,同期Intel芯片Mac的故障率约在1.8%到2.1%之间。
尤其是主板或不开机这类核心故障上,Intel机型是M系列的2.1倍。
故障率能砍一半,是因为集成消除了外接物理触点的各种风险:比如金手指氧化、针脚弯折、接触不良,任何一个出问题就整机趴窝。
而集成封装把CPU、GPU、内存控制器、神经引擎全部封装在一颗芯片上,主板组件数量大幅缩减,组件越少,故障点越少,自然故障也少。
这就有人会问了,照你这么说,统一内存就完美无瑕了呗,还说啥了,算你赢麻了得了。
别这么说啊,统一内存电脑当然不是万能的。
二、从0到1已经完成,剩下就是堆参数
我们以英伟达已经发布的RTX Spark为例,这是一颗把Blackwell RTX GPU和20核Grace CPU焊在一起的消费级超级芯片。
RTX Spark的GPU部分塞了6144个CUDA核心,跟RTX 5070笔记本版是同款规模,128GB LPDDR5X统一内存,本地能跑120B参数模型加百万token上下文。
前文在比较内存颗粒价格的时候,相信有不少人疑惑:两种内存颗粒,怎么就放一起比较?
这就是我想说的统一内存最大的短板:因为成本限制,只能采用LPDDR(5x),而LPDDR5X的系统内存带宽只有大约273GB每秒,桌面版5070配的是GDDR7显存,带宽672GB每秒,差了近三倍。
这个后果就是:游戏性能打不过传统独显。
因为游戏场景里纹理、几何、光影数据全从内存带宽过,LPDDR5X这条273GB每秒的窄水管拖了后腿。
英伟达官网截图
Computex期间,多家硬件评测机构的实测显示,在未经UMA专门优化的传统3A游戏场景下,同算力的统一内存平台比传统独显方案帧率低15%到25%。
至于英伟达在发布会上说玩3A能1440p跑100帧以上,肯定是靠DLSS的帧生成硬堆上去的,关掉插帧后原生帧率能到40就算它厉害了。
当显存的优势被夷平后,带宽就成了独显最后的护城河,也成了统一内存下一个要啃的骨头。
但对于科技产品来说,这并不是什么问题,因为基本都是先拿半成品上市,完成从零到一的跨越,剩下的就是堆参数做优化的事情,
所以说这个短板恰恰是迭代的起跑线,而不是终点。
但玩家们大可不必担心。核心数可以继续从6144往上堆,因为Blackwell架构本身就留了扩展空间;至于带宽方面,三星和SK海力士的LPDDR6今年底量产,可用带宽从约273 GB/s提升到约415 GB/s,提升近50%。
虽然帧率不会等比例翻倍,但足以把目前15%-25%的差距大幅缩小。
三、统一内存就是大势所趋
说了这么多,我的意思是,统一内存电脑在大模型时代就是趋势,就是主流。
目前的统一内存电脑,苹果用了六年时间把这条路从0走到1,从2020年M1到最新的M4,每一步都在证明消费端统一内存不但是可行的,而且正在吃掉传统PC的市场份额。
AMD更是抢在英伟达之前提前占位,锐龙AI MAX PRO 400系列用192GB统一内存锁定了AI工作站这个细分市场。
英伟达在GTC台北正式发布RTX Spark之后,宏碁、华硕、联想、戴尔、惠普、微软、微星七大OEM厂全部宣布跟进,首批搭载RTX Spark的笔记本和小型台式机预计今年秋季开始交付。
从苹果的一家独舞,到AMD和英伟达两年内相继入场,统一内存已经从“苹果在搞的那个东西”变成了“整个PC行业在搞的那个东西”。
英伟达官网截图
当入场的人多了以后,价格自然就会下降。
这和当年电动车取代燃油车的逻辑如出一辙,电动车不是靠跑得更快赢的,是靠能源效率和机械结构简化赢的。
统一内存不是靠算力更高赢的,是靠架构红利赢的:同样的容量成本更低,可以塞更多更大的模型,虽然速度慢,但同样的功耗产出更多,故障率还低。
当这三个条件同时成立的时候,主流市场的天平就会开始倾斜。
但独显并不会消失,就像燃油车不会灭绝一样,对于有游戏需求和跑打大模型需求的用户来说,统一内存电脑是最佳选择;但如果单纯是希望4k光追画质拉满的游戏发烧玩家或者是专业工作室做8K视频渲染和工业级3D建模,那独显永远是最好的选择。
现在花近四万块追一块5090,就像燃油车减产前抢一台V8发动机,情怀没错,但那台发动机没法驱动一台电动车。
热门跟贴