打开网易新闻 查看精彩图片

本人8月初在JD自营的“英伟达电脑办公京东自营专卖店”下单了DGX Sparkx2,价格是68595元。现在8月底去同一家店看了下,同一配置涨到75598元,短短20天,差价7000元。你说刚发布的Mac Studio价格会跟着涨吗?已发布的不一定,但512g内存的,肯定不会便宜。

这次涨价的直接推手,除了全球内存荒,还有一个被很多人忽略的关键变量:DeepSeek-V4-Flash-0731和Qwen3.8-27B这类小模型的爆发

小模型爆发:让本地跑大模型从"能跑"变成"好用"

7月31日,DeepSeek正式发布DeepSeek-V4-Flash-0731。这个模型总参数284B,但采用了MoE(混合专家)架构,每次推理只激活13B参数。这意味着什么?它可以在消费级硬件上以实用速度运行。

实测数据令人震撼:

  • DGX Spark(单台):DeepSeek-V4-Flash-0731在llama.cpp上达到单流19.7 tok/s,4路并发52 tok/s。官方优化后峰值可达78 tok/s
  • DGX Spark(两台集群):配合vLLM和推测解码,峰值78 tok/s,典型约55 tok/s

Qwen3.8-27B的表现同样惊艳,单台DGX Spark上单流75 tok/s,8路并发聚合吞吐246 tok/s

这些数字意味着什么?50 tok/s的推理速度,已经接近甚至超过云端API的体验。开发者终于可以在本地流畅运行顶级大模型,而不再受制于网络延迟和数据隐私问题。

打开网易新闻 查看精彩图片

需求井喷:从"能跑"到"好用"引发抢购潮

在DeepSeek-V4-Flash-0731发布之前,DGX Spark虽然也能跑大模型,但速度往往只有个位数tok/s,实用性有限。而新模型的到来彻底改变了局面,一台128GB统一内存的DGX Spark,突然变成了能够以实用速度运行顶级模型的"平民超算"

结果就是需求井喷:

  • DGX Spark自2025年10月发货以来,到2026年初就已售罄
  • 有开发者一次性投入三万美元购置三台Mac Studio、两台Mac Mini和一台DGX Spark用于本地模型部署。
  • 社区中关于"两台DGX实现token自由"的讨论热烈,甚至有开发者分享两台DGX Spark集群运行DeepSeek-V4-Flash-0731的完整方案
涨价逻辑:需求暴增遇上供给短缺

涨价是需求和供给双重挤压的结果:

  1. 内存成本飙升:全球LPDDR5X内存供应持续紧张,这是所有涨价的底层原因。
  2. 需求突然爆发:小模型的优异性能让DGX Spark和Mac Studio的"性价比"突然提升,更多开发者涌入购买。
  3. 供给弹性不足:高内存版本的设备产能有限,苹果甚至在3月下架了512GB版Mac Studio,5月又下架了256GB版

DGX Spark官方在2月27日宣布涨价17.5%,从3999美元涨至4699美元。而Mac Studio在6月25日也经历了全线涨价,M3 Ultra版更是单次跳涨约1300美元

接下来会怎样?

DeepSeek-V4-Flash-0731和Qwen3.8-27B只是开始。随着更多优化的小模型涌现,本地部署大模型的实用性会越来越强,对DGX Spark和Mac Studio这类高内存统一架构设备的需求只会继续增长。

而内存供应链的缓解,美光CEO表示可能要到2028年,意味着供给端短期不会改善。

需求在涨,供给受限,价格只会继续向上。你8月10日下单的68595元两套装,到8月底已经变成75598元,这7000元的差价,或许只是开始。

打开网易新闻 查看精彩图片