开发写着写着,token 烧得肉疼。算了半天想干脆换台 64G 的高配,本地跑个大模型,把 API 的钱全省了。真到挑看得上的配置新机,得两万多起步,我大概算了一下这笔账,有了下面这个结论。

打开网易新闻 查看精彩图片

大概很多人是这样吧

个人开发,为省 token 去买高配跑本地,多数不划算,用 API 反而更省。

账怎么算?就一条——三年净投入,等于买进来的钱,减去三年后卖出去回血的钱。买入、回血都按当下行情估的,仅供参考。算三年大概是一台Mac更换时间,实际可能用的更久。这里就先这么算。

三个选择:

  • 纯云端:买台 M1 Air 8+256(净投入约 1600),之后全靠 DeepSeek 的 API
  • 买新机:现行 M5 Pro 64G+1T,官网定制 29749,回血暂按 12000 估,净投入约 17749
  • 捡二手:同是 64G 的 M3 Max 笔记本,1.6 万入,回血 8500,净投入 7500

本地这两台装的都是同一个开源编码模型,Qwen3-Coder-30B,30B 参数。

这两天正好有个朋友说他现在用的就是64G内存的Mac,prefill太慢了,没法用于生产。但咱个人使用更高的配置价格就太贵了,反正我不舍得。上面说的Qwen模型对比DeepSeek V4.1-Flash肯定是弱的。想要达到同等水平怎么也得128G内存起步的Mac才行,要想运行流畅叠加百万级上下文,256G的怕是都有点勉强。你说512G的内存?那都跟我硬盘一样大了,更别说价格了,相当于你把一套偏远县城的房子放你桌上了。

打开网易新闻 查看精彩图片

Photo by AltumCode on Unsplash

本地方案比纯云端多掏的那部分净投入,够不够三年、够不够你每天几百万的 API 费用。

API 到底贵不贵?用的是 DeepSeek 的 V4.1-Flash,编码这种输入多输出少的活,平均下来约 0.0016 元/1k tokens。

拿这个价一摊,每台的回本门槛就出来了——只有当你每天真的烧到这么多 token,本地才不亏:

  • 新机:多掏约 16149 → 约 920 万 token/天
  • 二手:多掏约 5900 → 约 340 万/天

一天几百万 token 什么概念?重度编码、整天泡在编辑器里让模型自动补全跑任务,也就勉强摸到这个数,还得天天如此、连烧三年。一般个人开发、跑个把 app 的,根本到不了这个量级。新机更要烧到 920 万——那就更不用想了,省下的 token 费,远够不上那台机器的钱。

还有笔时间账没算:云端一秒回 80 到 150 token,本地只有 22 到 38,复杂任务更慢。省了 token,代价是每条都在等,写代码最怕等。再说本地能跑的是剪过枝的开源模型,复杂推理、长链条多数不如云端付费的能打。叠加上你自己部署、调试的时间,真是挺磨人的。而且现在大模型发展速度太快,本地部署的模型没准儿半年就落伍了,还要重新部署。之前的配置可能都要重来一遍。你就部署吧,一弄一个不吱声。

打开网易新闻 查看精彩图片

你选哪个?

那到底什么时候才值得本地?真的天天烧几百万 token、重度依赖、又不想把代码传别人服务器的,再考虑。很多时候token省了,时间不一定省。

你一天到底烧多少 token?

(买入、三年回血都是随行情估的,以官网和二手现价为准。)