本人8月初在JD自营的“英伟达电脑办公京东自营专卖店”下单了DGX Sparkx2,价格是68595元。现在8月底去同一家店看了下,同一配置涨到75598元,短短20天,差价7000元。你说刚发布的Mac Studio价格会跟着涨吗?已发布的不一定,但512g内存的,肯定不会便宜。
这次涨价的直接推手,除了全球内存荒,还有一个被很多人忽略的关键变量:DeepSeek-V4-Flash-0731和Qwen3.8-27B这类小模型的爆发。
小模型爆发:让本地跑大模型从"能跑"变成"好用"
7月31日,DeepSeek正式发布DeepSeek-V4-Flash-0731。这个模型总参数284B,但采用了MoE(混合专家)架构,每次推理只激活13B参数。这意味着什么?它可以在消费级硬件上以实用速度运行。
实测数据令人震撼:
- DGX Spark(单台):DeepSeek-V4-Flash-0731在llama.cpp上达到单流19.7 tok/s,4路并发52 tok/s。官方优化后峰值可达78 tok/s
- DGX Spark(两台集群):配合vLLM和推测解码,峰值78 tok/s,典型约55 tok/s
Qwen3.8-27B的表现同样惊艳,单台DGX Spark上单流75 tok/s,8路并发聚合吞吐246 tok/s。
这些数字意味着什么?50 tok/s的推理速度,已经接近甚至超过云端API的体验。开发者终于可以在本地流畅运行顶级大模型,而不再受制于网络延迟和数据隐私问题。
需求井喷:从"能跑"到"好用"引发抢购潮
在DeepSeek-V4-Flash-0731发布之前,DGX Spark虽然也能跑大模型,但速度往往只有个位数tok/s,实用性有限。而新模型的到来彻底改变了局面,一台128GB统一内存的DGX Spark,突然变成了能够以实用速度运行顶级模型的"平民超算"。
结果就是需求井喷:
- DGX Spark自2025年10月发货以来,到2026年初就已售罄
- 有开发者一次性投入三万美元购置三台Mac Studio、两台Mac Mini和一台DGX Spark用于本地模型部署。
- 社区中关于"两台DGX实现token自由"的讨论热烈,甚至有开发者分享两台DGX Spark集群运行DeepSeek-V4-Flash-0731的完整方案
涨价是需求和供给双重挤压的结果:
- 内存成本飙升:全球LPDDR5X内存供应持续紧张,这是所有涨价的底层原因。
- 需求突然爆发:小模型的优异性能让DGX Spark和Mac Studio的"性价比"突然提升,更多开发者涌入购买。
- 供给弹性不足:高内存版本的设备产能有限,苹果甚至在3月下架了512GB版Mac Studio,5月又下架了256GB版
DGX Spark官方在2月27日宣布涨价17.5%,从3999美元涨至4699美元。而Mac Studio在6月25日也经历了全线涨价,M3 Ultra版更是单次跳涨约1300美元。
接下来会怎样?
DeepSeek-V4-Flash-0731和Qwen3.8-27B只是开始。随着更多优化的小模型涌现,本地部署大模型的实用性会越来越强,对DGX Spark和Mac Studio这类高内存统一架构设备的需求只会继续增长。
而内存供应链的缓解,美光CEO表示可能要到2028年,意味着供给端短期不会改善。
需求在涨,供给受限,价格只会继续向上。你8月10日下单的68595元两套装,到8月底已经变成75598元,这7000元的差价,或许只是开始。
热门跟贴