谁也未曾预料,DeepSeek拿下国内AI领域首轮融资新纪录,动因竟是 Anthropic模型带来的技术压迫。
6月26日消息,据报道,2026年4月,Anthropic 公布了 Mythos(神话)预览版。一个被官方描述为"能发现并利用软件漏洞"的模型。
两周之后,DeepSeek创始人梁文锋决定接受外部融资。
三位知情人士表示,看到Anthropic的Mythos通过海量算力和数据训练获得强大能力之后,梁文锋意识到,没有巨额资金储备,DeepSeek将无法参与竞争。
因此,DeepSeek这家坚持“自掏腰包、不接风投、不做商业化”两年多的中国AI实验室,仅仅因为梁文锋看了别人家一次模型发布,就改了主意,选择了市场化资本。
而且,梁文锋自掏了200亿元进行入股。
这件事听起来有点戏剧性,但其实是 DeepSeek 三年历史上最重要的一个转折点——也是这家中国 AI 实验室,第一次被美国同行的某个具体动作,真实地逼到了墙角的证据。
Mythos不是一款竞品,它是一个信号:前沿 AI 的下一阶段,赌注会大到只有国家级玩家才能下场。
DeepSeek 在今年6月完成总额74亿美元(约合人民币500亿元)融资,估值500亿美元左右,创下了中国初创公司首轮融资规模的历史纪录。
这次融资结构很反常。
梁文锋个人出资200亿人民币(约30亿美元),占融资总额的五分之二。
换句话说,他一边告诉外界"我不要外部的钱",一边又自己开了中国风投史上最大的一张个人支票,亲手把这家公司的天花板抬到了500亿美元。
而所有外部资金加在一起,才刚刚超过他自己掏的那一份。
这不是融资。
这是一场被精心包装成融资的自我定价。
事实上,报道称,梁文锋起初并不抗拒寻求风投融资,因为他深知 AI 研发是烧钱的游戏。
但 2023 年,他一句话把潜在投资人全劝退了——他告诉他们,DeepSeek 将专注于深度研究与科学探索,不设任何商业或产品路线图。
最终,DeepSeek 由梁文锋和他的幻方量化“自掏腰包”支撑起来。
梁文锋非常热爱骑行穿梭于城市与乡间,属于户外派。
因此,他一直鼓励员工保持工作与生活的平衡。这在国内科技圈几乎闻所未闻——大厂员工必须忍受超长工时。
但梁文锋认为,任何人的最优生产力每天只能维持6到8小时,超出这个时长再苦熬毫无意义。
而且,DeepSeek组织架构非常扁平,层级稀薄。DeepSeek没有专门的人力资源或公共事务部门,每位研究员都直接向梁文锋汇报。
他本人保持亲力亲为的姿态,参加大多数研究讨论会议。作为本轮人员扩张的一部分,公司正在招聘人力、财务、法务、采购和行政岗位。
值得一提的是,Anthropic 在描述 Mythos 的时候,用了一句在任何 AI 公司技术文档里都不常见的话:模型强大到可以发现并利用软件漏洞,"为潜在的混乱与滥用打开了大门"。
这句话有两层含义。
第一层是技术声明:Mythos 的能力阈值跨过了某个临界点。
第二层是政治声明:Anthropic 在用"潜在混乱"自我设限——这意味着他们认为模型已经接近危险。
梁文锋看到了第二层。
DeepSeek此前的路线是,高效研究的异类,靠几百人、较紧张的算力,做出与美国头部模型能力相近的结果。
但是,DeepSeek R1 和 Mythos 不在一个量级。
Mythos 这种级别的能力,背后是 Anthropic 长期堆算力、堆数据、堆合规体系堆出来的工程厚度。这不是某种"高效率方法论"可以平替的。它需要的是规模,规模需要的是钱,钱只能从外面来。
梁文锋明白这一点。所以 Mythos 一发布,他就明白了。
Mythos让DeepSeek意识到,“高效小团队”叙事从这一刻起就破产了。
Mythos 证明了,AI的下一仗不能用少花钱的方式打。两件事并不矛盾,但战略含义完全相反——前者鼓励独立,后者要求结盟。
梁文锋选了结盟。
但他用了一种很梁文锋的方式:自己掏最大份额,控制权不让渡。他接受了市场,但没有接受资本。
Mythos 级别能力的出现,把这个矛盾推到了一个临界点。
如果 DeepSeek 真的做出 Mythos 同级别的模型,那么它的能力会成为新的国家模型。
梁文锋想做 AGI,而且需要可控的 AGI。
这两件事在 Mythos 之前可以并存,在 Mythos 之后很难。
500亿已经到账。
DeepSeek公开说要“至少翻倍”招聘——300 人变成至少 600 人,覆盖 AI 系统、基础设施、产品和深度研究。
同时,DeepSeek公司在加速适配华为芯片。
这意味着 DeepSeek 必须在CUDA之外,重新搭建一套训练和推理栈。
但DeepSeek去年已经做过一次,结果是整整 15 个月没发布新一代模型,一整年缺席了AI大模型竞争,并让Anthropic 的 Claude Code 工具引爆了AI Coding Agent 浪潮。
DeepSeek 完全错过。梁文锋在路演里告诉投资人:编程工具和 AI 聊天机器人一样,只是 AI 演进过程中的过渡性产品。如果 DeepSeek 把筹码押在这些短期产品上,就会偏离实现 AGI 的终极目标。
这句话听起来很酷。但一个错过浪潮的人说“浪潮不重要”,到底是真有远见,还是自我安慰,外人无从判断。
41 岁的梁文锋,给身边人讲过一句话:AI 不应被少数人控制。
这句话本身不稀奇,每个 AI 公司的 CEO 都会讲。但 DeepSeek 是唯一一家把全系列模型的底层代码开源的主要 AI 实验室。
最新DeepSeek V4 Flash模型,价格只有 Anthropic 同类模型的1/20到1/50,模型使用率飙升。这说明,美国开发者已经用脚投票了——不是因为 DeepSeek 的模型比 Anthropic 强,而是因为便宜。
在一个对价格越来越敏感的市场里,"足够好 + 便宜到不行"就是硬通货。
但这也意味着 DeepSeek 的护城河,是价格。
然而,开源模型解决的是“知识不应被垄断”的问题,不解决“算力不应被垄断”的问题。
Mythos 让 DeepSeek 意识到了后半句的残酷——开源不能当饭吃,尤其当对手开始堆算力的时候。
梁文锋才在两年多的拒绝之后,第一次向外部资本打开了门。
所以这才有了DeepSeek 500亿元巨额融资,甚至梁文锋自掏200亿元——这是DeepSeek用来买时间跑向下一道护城河的钱。
当一个研究理想主义者决定下场玩一场资本游戏,他能保留多少自己?
梁文锋的答案是:至少先掏 200 亿,保留 40% 的控制权。
这个答案能撑多久,取决于 Mythos 的下一版什么时候发布。
热门跟贴