8月13日晚上,DeepSeek做了一件很多人第一眼没看懂的事。它没有发新模型,没有晒跑分,而是把一个叫 Harness 的东西开源了。半小时,GitHub 涨了一万颗星。到发稿时,已经超过三万。
上一次 DeepSeek 的 R1 冲到两万星,用了五天半。这一次,Harness 只花了一个半小时,直接创下 GitHub 史上最快涨星纪录。开发者社区的兴奋隔着屏幕都能感觉到,有人直接喊出:这是"向 Claude Code 说再见的那一天"。
但冷静下来看,这件事的意义,远不止一个开源项目火了那么简单。它撕开的,是 AI 编程领域一条被两家公司垄断了太久的裂缝。
半小时破万星,开源圈等这一刻太久了
DeepSeek Harness 到底是什么?官方给了个公式:模型加 Harness,等于 Agent。
翻译成人话就是,大模型是大脑,只会想;Harness 是手和脚,负责把想法变成动作——拉代码、改文件、跑测试、调工具、判断任务到底做没做完。过去半年,AI 编程圈争论的核心,早就从"哪个模型更强"悄悄换成了"谁能把模型装进一个更好用的系统"。这套系统,就叫 Harness。
为什么开发者这么激动?因为过去这件事,被两家公司牢牢捏在手里:OpenAI 的 Codex,Anthropic 的 Claude Code。你想用,得付费,得接受它们的规则,得把代码和数据交给它们的云。DeepSeek 这一次,直接把 Harness 用 MIT 协议开源了,还明确放话:不绑定自家模型。
也就是说,你可以用 DeepSeek 的模型,也可以接 OpenAI、Kimi、Google,近四十家随便换。模型成了可替换的零件,框架才是那个你真正攥在自己手里的东西。对国内开发者而言,这句话的分量,比任何跑分都重。
从卖模型到抢入口,这一步是必走的棋
很多人会问,DeepSeek 明明靠卖模型就已经活得不错,为什么非要挤进 Agent 这条拥挤的赛道?答案藏在"模型供应商"这个身份的天生尴尬里。
做模型供应商,意味着你永远只是别人产品里的一个零件。今天你的模型便宜好用,开发者把你接进去;明天隔壁出了更强更便宜的,一行配置就把你换掉。你没有自己的入口,没有自己的用户,定价权和数据权都不在你手里。真正值钱的,是"模型之上"那一层——谁能决定开发者怎么用模型、走什么流程、信任谁。
Harness 就是 DeepSeek 往这一层走的动作。早在五月,DeepSeek 资深研究员陈德里就在社交平台发帖招人,明确说要对标 Anthropic 的 Claude Code。后来 Harness 团队负责人崔添翼也公开承认,团队"每天都在面试"。半年磨一剑,等到的不仅是一个开源项目,而是一次身份的重置:从卖发动机,到造整车。
更关键的是闭环。有了自己的 Agent 产品,模型和框架就能互相喂反馈——产品端的真实使用数据,反过来告诉模型哪里不行,模型迭代又立刻在产品里得到验证。这个"模型迭代、产品验证、反馈优化"的循环一旦转起来,速度是单纯卖模型永远追不上的。
连 Agent Loop 都能拆,模型第一次变成零件
Harness 最狠的一招,叫"一切皆插件"。
市面上绝大多数编程 Agent,只让你在工具和技能层做点扩展,比如加个搜索、接个数据库,核心循环是焊死的。DeepSeek Harness 直接把插件的边界一路下沉到了运行时:模型、工具、技能、会话、沙箱、存储,甚至 Agent 怎么循环、怎么调度子任务、最后用什么样的界面,全都是插件。
这意味着什么?意味着一个开发者可以完全不动框架源码,就把"AI 怎么思考、怎么干活"的每一个环节拆开重组。你想换掉它的执行循环,可以;你想给它加一套自己的调度逻辑,也可以。背后撑起这套架构的,是一个叫 Cordis 的插件系统,思想来自北京大学和 DeepSeek 联合署名的一篇论文。
内测期间,769 位开发者已经贡献了约三百个插件,从长期记忆到 UI 定制,从模型自我进化到游戏开发。生态在正式开源之前,就已经自己长了出来。这说明什么?说明国内开发者憋了太久,缺的从来不是热情,是一块能放手去搭的底座。
前量化大佬带队,把交易的可靠性塞进框架
很多人注意到一个细节:Harness 团队负责人是崔添翼,前 Jane Street 的量化交易专家,干了整整九年。
量化交易和 AI 编程有什么关系?关系大了。交易系统最看重的,恰恰是现在 AI 编程 Agent 最稀缺的东西:长时间运行不能崩,出错要能自动恢复,每一笔操作都要留痕、可回溯。你以为的"高级技术",其实是人家吃饭的本能。
崔添翼把这套基因直接带进了 Harness:自动存档、断点续传、Session 回放、失败自动重试或降级。意思是,AI 跑一个几小时的长任务,中途挂了,能从断点接着干,而不是从头再来;你还能回放它每一步的思考过程,看清楚它到底在哪个环节拐错了弯。
对国内开发者来说,这是最解渴的一点。过去大家用的是"DeepSeek 模型加别人的壳",壳好不好用,自己说了不算,出了 bug 只能干瞪眼。现在原厂把壳也做出来了,还开源,等于把锅也一起端给你了。
一行命令,五分钟上手,门槛低得不像话
如果说"一切皆插件"是 Harness 的硬实力,那它的上手门槛,就是最柔软的敲门砖。
你不需要配复杂的 Python 环境,也不用折腾一堆依赖。装好 Node.js,在终端里敲一行命令,浏览器就会自动弹出一个简洁的 Web 界面,工作区和对话区一目了然。从零到第一次跑通,大概五分钟。
更贴心的是四种预设模式。标准模式,是完整的编程助手,能理解需求、改代码、跑命令、看结果;PTC 模式,让你用 TypeScript 写小程序,把多步操作拼成自动化流程;极简模式,只留终端和基础文本替换,适合那种明确到不需要思考的小改动,官方当初就用它来测试 V4 模型;创造模式,则允许你在运行时试验新插件、新玩法。
这个门槛之低,本身就是一种战略。它要的不是少数几个精英开发者,而是最大公约数的程序员群体。门槛每低一分,生态就大一圈。DeepSeek 要的,是一个人人都能上手、然后人人都愿意留下插件的基础设施。
反手开源,直指 Claude Code 的护城河
Claude Code 一年订阅费大概一千二百美元,这是它最值钱的那条护城河。DeepSeek 用 MIT 开源,等于直接把这沟水填平了。
有人会抬杠:一个刚发 v0.1 的预览版,拿什么跟打磨成熟的 Claude Code 比?这话没错。但 DeepSeek 的算盘,从来不是"今天取代谁",而是"把标准攥在自己手里"。
当模型之上的执行层被一家公司垄断,定价权、数据权、规则解释权,全都在它手里。DeepSeek 把这一层开源,等于向所有人摊牌:底座是大家的,谁都能在上面盖房子。谁能吸引最多的插件、最多的开发者,谁就掌握了下一个十年的入口。
这场仗,比模型性能的仗,重要十倍。性能可以慢慢追,入口丢了就真的没了。
模型只是发动机,谁能造出整辆车、还免费把图纸发出来,谁才是下一个十年的话事人。DeepSeek 把图纸发出来了。接下来,看谁能把车开得最远。
热门跟贴