先给答案,省得你白紧张: 不到7000元 ,一次性。 之后模型免费、Token 免费,剩下的只有电费,即使全功率推理,每小时才不到0.2元。

不是估算,是 我自己的账单 。这台机器现在跑着 Qwen3.8-27B,24G 显存把模型全装进去,配 DFlash2 投机解码,英文推理 100 token/s 往上,接了 Hermes、opencode、企业微信,真在干活——写文章、改代码、跑回测,全是它。

我攒的家庭大模型工作站全家福

一、初始配置:6000-7000元

这台机器是 2026 年 8 月初开始攒的,当时花的钱:

表注:以上均为实付价,2026 年 8 月初购入。

1350 + 4600 + 620 = 6570 元。 注意一个细节:P520 主机那 1350 里,CPU 是初始自带的,后面我把它升级成了 W-2155 ,这笔钱在下面算。

二、升级:又花 1487 元

表注:2026年8月底的升级费用

687 + 800 = 1487 元。 加上初始的 6570, 整机总账 8057 元 。

这里得说一句实话:我这套是 2026年8月初 买的。那之后显卡和内存都涨价了,你要是现在照着买, 大概率不止8057 。这笔账是"我的价格",不是"现在的市场价"。

三、大头之外:0 元的那些

打开网易新闻 查看精彩图片

很多人问大模型要花多少钱,默认答案都是"调用 API 按 Token 计费"。我这套路线里, 软件这一整层是 0 元 :

01 模型本身:0元。 Qwen3.8-27B全开源,下载就是使用,不卖 Token、不看使用量。

02 推理引擎 llama.cpp:0 元。 开源,编译完就是你的。

03 Agent 框架 Hermes + 编码工具 opencode:0 元。 都开源。

04 企业微信入口:0 元。 自建应用机器人,手机上不装任何新 App。

05 Token:0 元,且没有上限。 这是和云端最本质的区别——云端按量计费,用得越狠越贵;本地是 用多少都不产生账单 ,写爆它、让它跑一整夜回测,第二天醒来电费单上多几毛钱。

所以家庭大模型服务器装好之后,这台机器的"使用费"只剩电费。

四、没算进去的钱,一并交代

打开网易新闻 查看精彩图片

① 固态升级到 1.5T 的钱没立账 ,没记具体花了多少,8057 里不含它。9月初买了1T固态,790元。

② 电价按 0.55 元/度估算。 7900 XTX 满载时整机两百瓦(功率上限300瓦,大模型推理实际用不到那么高),我做过功耗优化(空闲时 GPU 掉到 15W 附近),1个小时内全部满载推理,也就0.19元左右,便宜!

③ 时间没算钱。 编译驱动、调参数、踩OOM的坑,前后花了不短时间。这钱算不出来,不是白花。

你的预算是多少、打算跑多大的模型?评论区聊聊。

家庭大模型服务器系列回顾

第1~6篇 ✅ 攒机→装机→llama.cpp→调优→远程→Hermes→多用户

第7~9篇 ✅ MiniMax H3 部署→OOM→速度优化

第10~14篇 ✅ 功耗 / 硬件 /升级

0 元复刻「个人超级助手」: 树莓派可试,数据不出家门

华为手机杀后台 15 秒一次? 我把同步软件全删了,只留 2 个 App

立省 1000 元!960万toekn! 真不用买什么4090了!

Token自由!接入hermes和opencode,家庭大模型服务器原地起飞!

普通人怎么用大模型赚钱? 大模型深度检索后,我得到几个反直觉的结论。

让27B本地模型真正能干活,实现Token自由,根本不用4090!

Token自由之后,远程指挥27B 大模型干活: 手机 0 元远程指挥,不用装新 App

打开网易新闻 查看精彩图片

#大模型 #千问 #家庭 #助手 #4090 #7900XTX