曝DeepSeek计划明年上市

打开网易新闻 查看精彩图片

DeepSeek冲刺IPO:中国AI“黑马”的商业化跃迁与创始人梁文锋的极客理想

2026年,中国人工智能赛道迎来一个标志性时刻——被称为“AI界拼多多”的DeepSeek,正式踏上了IPO的冲刺之路。

据多家媒体报道,这家成立仅三年的大模型公司已启动上市筹备工作,目标锁定2027年完成IPO,最快可能在今年底迈出关键一步。消息传出后,资本市场与科技圈同时震动。这不仅因为DeepSeek以极致性价比改写了大模型的成本规则,更因为它的上市,将为中国AI产业的商业化路径提供一个前所未有的观察样本。

打开网易新闻 查看精彩图片

一、横空出世:一场从量化交易到AGI的跨界冒险

DeepSeek的故事,始于一个看似与人工智能毫不相干的领域——量化金融。

2015年,浙江大学电子信息工程专业毕业的梁文锋,与同学徐进共同创办了幻方量化。凭借数学与算法的深厚功底,幻方迅速崛起为中国头部的量化对冲基金,管理规模一度突破千亿元。然而,金融市场的数字博弈并未让梁文锋感到满足。2023年,他做出了一个令业界侧目的决定:将幻方量化的技术积累和资金实力,全部押注于一个全新的方向——通用人工智能。

这一年,DeepSeek正式成立。

与大多数AI创业公司不同,DeepSeek从一开始就展现出鲜明的“反共识”气质。当同行们争相融资、烧钱买算力、跑马圈地时,DeepSeek选择了一条截然不同的道路:不追求参数规模的最大化,而是专注于模型效率的极致提升。这种思路的直接产物,便是2024年底引发全球关注的DeepSeek-V3模型。

打开网易新闻 查看精彩图片

二、改写规则:用“性价比”撕开巨头防线

2024年12月,DeepSeek-V3发布,其训练成本仅为557万美元——这个数字震惊了整个AI行业。作为对比,OpenAI的GPT-4等同等量级模型的训练成本,通常在数亿美元级别。DeepSeek用不足竞争对手十分之一甚至百分之一的成本,实现了接近顶尖水平的性能表现。

“这不是简单的成本优化,而是一次架构层面的创新。”一位AI领域投资人如此评价。DeepSeek-V3采用了自研的MLA架构和自研Sparse结构MoE,将模型的计算效率推向了前所未有的高度。这背后,是梁文锋“不为规模而规模”的工程哲学——在他看来,算力从来不是真正的壁垒,真正的壁垒在于如何聪明地使用算力。

如果说V3让DeepSeek赢得了技术圈的尊重,那么2025年1月发布的R1推理模型,则让它真正出圈。这款具备深度思考能力的模型,在数学、编程、逻辑推理等任务上展现出惊人的能力,甚至在某些基准测试中超越了OpenAI的o1模型。更重要的是,DeepSeek将这一能力以极低的API价格推向市场,引发了一场席卷全球的“模型价格战”。

“DeepSeek重新定义了AI的性价比。”一位云计算行业分析师指出,“在它之前,大家默认高质量推理模型就应该贵;在它之后,贵反而成了需要解释的事情。”

三、开源信仰与商业野心的平衡术

在商业化策略上,DeepSeek同样走出了一条独特的路线。

与OpenAI逐步走向闭源不同,DeepSeek始终坚守开源策略。从V2到V3再到R1,每一代核心模型都面向全球开发者开放。这种“技术平权”的姿态,为DeepSeek赢得了全球开发者社区的广泛赞誉,也让它在中国AI公司中拥有了独特的品牌辨识度。

然而,开源并不等于不赚钱。DeepSeek的商业化路径,建立在开源模型驱动的生态效应之上:免费的开源模型带来海量用户和开发者,而在企业级部署、高级API服务、私有化解决方案等增值层面实现盈利。这种“基础免费、增值收费”的模式,在软件行业早已被验证,但在大模型领域,DeepSeek是走得最远的一个。

数据显示,截至2025年底,DeepSeek的API日调用量已突破百亿次,服务覆盖金融、教育、医疗、法律等多个行业。其企业级产品DeepSeek Enterprise已签约超过200家大型客户,客单价从数十万到上千万元不等。尽管公司未公开详细财务数据,但据知情人士透露,DeepSeek在2025年四季度已接近盈亏平衡。

四、梁文锋:一个“非典型”创始人

要理解DeepSeek,必须理解梁文锋。

在喧嚣的AI创业圈里,梁文锋是一个低调到近乎“隐形”的存在。他极少接受媒体采访,不在社交平台上发声,也不参与行业论坛的“圆桌论道”。为数不多的公开信息显示,这位80后创始人毕业于浙江大学,拥有电子信息工程学士和硕士学位,早年在量化投资领域积累了深厚的技术功底和资本实力。

“他更像一个工程师,而不是企业家。”一位接近梁文锋的人士这样描述。在DeepSeek内部,梁文锋深度参与技术决策,据说至今仍会亲自review核心代码。公司员工称他为“锋哥”,而非“梁总”——这种去等级化的文化,与硅谷的科技公司如出一辙。

但梁文锋并非不问世事的书斋型极客。从量化投资到AI大模型,他的每一步选择都展现出敏锐的商业嗅觉。2025年,DeepSeek先后完成两轮融资,估值从年初的150亿美元飙升至年底的数百亿美元,背后站满了红杉中国、高瓴资本、腾讯投资等一线资本。梁文锋本人也以330亿元的财富登上2025年胡润百富榜,位列第128位。

在2025年的一次内部全员会上,梁文锋罕见地谈到了自己的愿景:“我们不是在做一个生意,而是在参与一场定义未来的竞赛。AGI不是某一家公司的私有财产,而是全人类的技术红利。DeepSeek的角色,是让这个红利尽可能早、尽可能公平地惠及每一个人。”

这番话在很大程度上解释了DeepSeek的战略选择:为什么坚持开源,为什么死磕性价比,为什么在商业化上显得“克制”——在梁文锋的蓝图中,商业成功是手段,技术普惠才是目的。

五、IPO猜想:估值、时机与挑战

回到IPO本身,市场对DeepSeek的上市充满期待,同时也充满疑问。

首先是估值。据知情人士透露,DeepSeek的IPO目标估值可能落在400亿至600亿美元区间。这将是继商汤科技之后,中国AI领域最大规模的IPO之一。考虑到DeepSeek目前的收入规模和盈利状况,这一估值主要建立在其技术领先性和市场想象空间之上。

其次是时机。2027年完成IPO的目标,意味着DeepSeek需要在未来一年多内完成股份制改造、财务规范化、上市辅导等一系列准备工作。对于一家成立仅三年、尚处于高速发展期的公司而言,这无疑是一场与时间的赛跑。

更关键的挑战在于竞争格局。2026年,中国大模型赛道已进入“下半场”。字节跳动的豆包、百度的文心一言、阿里的通义千问、腾讯的混元等大厂模型,正在依托各自的生态优势加速商业化。与此同时,月之暗面、智谱AI、MiniMax等独立AI公司也在紧追不舍。DeepSeek的先发优势能否持续,将是投资者最关心的问题。

此外,地缘政治因素也不容忽视。美国对华AI芯片出口管制的持续加码,给中国AI公司的算力供应链带来了不确定性。尽管DeepSeek以高效训练著称,但在推理算力的持续供应上,仍需面对芯片受限的现实约束。

打开网易新闻 查看精彩图片

六、象征意义:一家“非典型”AI公司的上市之路

DeepSeek若成功上市,其意义远不止于一家公司的资本化。

从行业角度看,它将为中国AI产业提供一套可参照的商业化范本——不依赖大厂输血、不以烧钱换增长、不以模型参数讲故事,而是靠技术效率和产品体验赢得市场。这条路径若能跑通,将极大地提振整个赛道的信心。

从更宏观的视角看,DeepSeek的IPO是“中国式创新”的一次集中展演。在国际AI竞争日益激烈、技术脱钩风险加剧的背景下,一家中国公司用更低的成本做出了世界级的大模型,这本身就具有强烈的象征意味。

“DeepSeek证明了一件事:技术创新的路径从来不止一条。”一位行业观察者写道,“当所有人都在追逐算力规模时,有人在思考如何让每一单位算力发挥更大的价值。这种‘效率优先’的思维,可能是中国AI出海真正有力的武器。”

当然,故事还没有写完。从筹备到挂牌,再到上市后的持续发展,DeepSeek面前的路并不平坦。但无论如何,这家公司已经用三年时间,在中国AI史上刻下了自己的名字。接下来,它需要证明:奇袭可以赢下一场战役,而持续的创新与稳健的商业化,才能赢得整场战争。

(本文综合网络公开信息撰写,DeepSeek官方未就上市传闻作出正式回应,具体上市计划以监管机构披露及公司公告为准。)