2025年初,全世界几乎同时被一个中国名字震了一下——DeepSeek,深度求索。
它的模型DeepSeek-V3、R1接连发布,性能冲进全球顶尖行列,华尔街、硅谷、各大媒体都在讨论这家公司。可当人们想认识背后的创始人时,却发现他几乎没有公开资料,很少露面,不参加行业大会,不在社交平台发声。
他叫梁文锋,1985年生人,那一年刚好四十岁。
他的公司造过两台超级计算机,一台叫“萤火一号”,一台叫“萤火二号”。
萤火。
一只在暗处飞了十六年的萤火。
梁文锋出生在广东湛江吴川,一个叫米历岭的小村庄。父亲是小学老师。1990年代,广东遍地是赚钱的机会,不少家长觉得读书没用,到他家来劝,说的基本就是“读书有什么用”。
但那个小学老师的儿子,2002年高考,吴川市状元。
他后来分享过一句学习经验:“要重视自学,不要单纯满足跟老师走,要有自己的学习计划、方法、目标与标准要求。”
那时候他十七岁,还不知道这句话会陪他走多远。但从后来的路看,他几乎一生都在实践这句话:不跟风,不随大流,有自己的计划和标准。
梁文峰毕业于浙江大学。毕业后,他没有去大厂,没有进体制,而是带着几个人,闷头做一件事:用机器学习做全自动量化交易。
后来的媒体都喜欢讲他2015年创立幻方量化、2019年管理规模破百亿、2021年破千亿的故事,好像一切水到渠成。但他自己说:“外部看到的是幻方2015年后的部分,但其实我们做了16年。”
从2008到2023,一个人最好的青春,全部花在一件当时没多少人看得懂、也不确定有没有结果的事情上。
2016年,幻方推出了第一个AI模型。2020年,萤火一号投入运作。2021年,他投入十个亿建设萤火二号,那一年,幻方资产管理规模突破千亿。
到这一步,他四十岁不到,已经是一个管理千亿资金、拥有一套顶级AI算力的量化大佬。按照世俗的标准,他早就“成功”了,可以收手了,可以享受了。
但他没有。
2023年7月,他宣布成立大模型公司DeepSeek,进军通用人工智能。
四十岁,功成名就之后,他把自己重新扔进一条更险、更烧钱、更不确定的赛道。
有人问他为什么。他在少有的几次公开发言里说过:AI未来创造的价值足够巨大,可能会占人类社会GDP的10%,没有任何一家企业能够独占这样一个市场。
他不是去抢蛋糕的,他是觉得这件事值得做。
DeepSeek成立以后,行业里流行“百模大战”,各家抢融资、抢声量、抢商业故事。梁文锋反着来:不对外发声,不急于融资,把大部分资源投入模型研发。
今年一份他与投资人的内部交流会实录流传出来,他反复提到一个词——克制。“克制是一种战略。”
比如开源。当OpenAI们把模型越关越紧,DeepSeek坚持把模型开源。他说如果试图独占利益,最终会被历史淘汰。
比如定价。他不追求商业利益最大化,只求“合理”利润——“大概是我们到市场上买一批设备回来,十个月收回成本”。
比如用人。他招人不设限,公司没有繁琐的组织管理体系,扁平、自由、互帮互助,靠一个共同目标把大家聚在一起。有人这样形容DeepSeek的氛围:大家一起“坐火箭”,缺了谁都不行。
他最骄傲的,大概是团队。有人夸DeepSeek雇佣了“高深莫测的奇才”,他的回应是:做出DeepSeek-V2模型的没有海外回来的人,都是本土的——有毕业几年的年轻人,也有顶尖高校的应届生和博士实习生。
一个四十岁的人,带着一群平均二十几岁的年轻人,在一个被硅谷垄断话语权的领域,用开源和克制,撕开了一道口子。
后来的事大家都知道了。DeepSeek-V3、R1接连发布,全球震动,他登上富豪榜,被媒体称作全球AI领域的新首富,论文登上《自然》封面,和黄仁勋坐在一起谈芯片。
可我总是想起那两台超算的名字。
萤火一号。萤火二号。
在广东的乡间,夏夜是能看到萤火的。一只萤火虫的光,微弱得几乎可以忽略不计,但它们从不在白天出来争抢太阳,只在夜里,一点一点地亮。
梁文锋就是这样的光。
从吴川的小村庄,到杭州的实验室;从2008年那个没人看得懂的决定,到2023年那个四十岁的转身;从16年的暗处,到2025年全世界的目光。他没有追过光,他只是在自己认定的地方,一直亮着。
直到足够多的萤火聚在一起,照亮了一条路。
四十岁那年,他让世界看见了一只飞了十六年的萤火。
热门跟贴