之前靠算法打破美国芯片封锁的DeepSeek,最近搞了个大动作直接炸了外媒圈。当初人家拿两千多张H800,花了不到六百万美元就训出了顶级大模型,靠省钱省出了国产AI的招牌,谁都夸这路子太聪明。结果刚拿到五百亿融资,转头就扎去内蒙建超大型数据中心,这波操作让不少人看懵了。

打开网易新闻 查看精彩图片

2024年底DeepSeekV3出来的时候,整个AI圈都被震住了。6710亿参数的大模型,只用了2048张英伟达H800,55天搞定,总成本才557.6万美元,这个价格只是GPT-4o的几十分之一。本来美国卡着芯片想封锁我们,结果人家用算法把窟窿捅开了,外网直接炸锅。

靠算法提效率,这是DeepSeek当初出圈的核心。人家改了架构,优化了训练方法,硬生生把算力利用率拉到了63%。比GPT-4o的41%高了一半还多,训练效率比Meta的Llama 3更是翻了11倍,硬是把少卡用出了多卡的效果。那段时间不少人都说,这才是中国AI该走的路子,不靠堆钱靠脑子。

打开网易新闻 查看精彩图片

谁能想到,不到两年,画风直接变了。2026年6月,DeepSeek完成了首轮外部融资,总金额超过500亿人民币,这是中国AI圈有史以来最大的单轮融资。创始人梁文锋自己掏了200亿,占总融资额的四成,是最大单一投资方,腾讯出100亿,宁德时代出50亿,剩下的网易京东这些行业大佬也都跟着投。

要知道,之前梁文锋可是出了名地不接受外部融资。当初V3爆火之后,多少资本追着要送钱,人家都不收。这回不仅破了不融资的例,自己还先掏了真金白银,这态度转变,太出乎所有人意料了。

钱刚到账,DeepSeek的动作快得离谱。早在4月份,乌兰察布就放出了DeepSeek招数据中心运维的消息,月薪三万一年14薪,这是这家公司第一次招物理基础设施相关的岗位。之前DeepSeek一直都是租云服务用,从来没自己建过机房,这次明显是要来真的了。

打开网易新闻 查看精彩图片

彭博社爆出来的消息说,DeepSeek要在乌兰察布建一个1GW规模的AI数据中心,部分算力最早2027年底就能投入运行。乌兰察布本来就是国家东数西算的枢纽节点,离北京不到三百五十公里,电价便宜天气还凉,建数据中心的条件国内找不到几个比它好的。这回DeepSeek的心思,明眼人都能看出来了。

1GW是什么概念,这已经是超大型数据中心的电力容量了。之前DeepSeek靠着2048张H800打天下,讲究的是把每一张卡的算力都用到极致,现在直接奔着GW级去了,路线转得太干脆。从“省着用卡”到“拼命堆算力”,这步跨得可不是一般大。

外媒现在已经慌了,几家顶级财经媒体轮着报道这件事,又开始说美国的芯片封锁没用了。一个被卡着脖子的公司,融了五百亿建超大算力中心,明摆着告诉全世界,封锁根本挡不住中国AI往前走。这事看着提气,但细想下来,也有点让人犯嘀咕。

打开网易新闻 查看精彩图片

本来DeepSeek是中国AI的一个异数。之前国内科技公司做啥都喜欢堆,堆人堆钱堆规模,DeepSeek出来的时候,给大家展示了另一条路,不靠堆钱靠技术,靠工程师的脑子破局。现在它也转去堆算力,会不会把当初最亮眼的优势给丢了。

你说这事有错吗?其实也不能说DeepSeek走错了。现在做AI就是这样,算法再厉害,要做真正的通用人工智能,没有足够大的算力底座撑着,根本跑不起来。所有头部AI公司最后都得走这一步,没人能绕开。

但大家担心的点也很实在。当初你靠算法效率打出的名声,告诉全世界我们能靠聪明打破封锁,现在转头就比谁烧钱多,和美国那些科技巨头的玩法还有啥区别。你烧五百亿建数据中心,人家烧一千亿建更大的,最后不还是回到谁钱多谁赢的老路上了。

打开网易新闻 查看精彩图片

从靠脑子破局到靠资本堆规模,梁文锋两年就走完了这个转变。从技术信仰转到资本信仰,这条路其实是很多中国科技公司都走过的。DeepSeek这步,到底是成长必经之路,还是丢了初心,现在谁也说不好。

打开网易新闻 查看精彩图片

当初那个拿不到足够芯片,还能拼出顶级大模型的DeepSeek,现在揣着五百亿去建大机房,它还是当初那个让全世界刮目相看的DeepSeek吗。中国AI从靠着小聪明求生,到放开手脚烧钱扩张,这中间的困惑,可比外媒的恐慌有意思多了。

参考资料:新华网 中国人工智能产业发展新闻报道