一、合作动态:全球云厂商“抢滩”DeepSeek,中美技术生态深度融合
2025年1月以来,中国AI初创公司深度求索(DeepSeek)凭借开源模型DeepSeek-R1和V3系列的“低成本、高性能”优势,迅速成为全球科技巨头的“标配”。其模型以3%的成本对标OpenAI,在推理速度、多模态任务处理等关键指标上表现突出,甚至部分超越GPT-4和Claude-3.5-Sonnet。
1. 美国科技巨头的“真香”选择
- 微软:尽管是OpenAI的最大投资者,微软仍于1月29日将DeepSeek-R1模型集成至Azure AI Foundry和GitHub,并计划在Copilot+ PC端本地运行。
- 英伟达:通过NVIDIA NIM微服务提供DeepSeek-R1,单块H200 GPU每秒可处理3872个Token,开发者可通过API快速调用。
- 亚马逊:在Amazon Bedrock和SageMaker平台上线R1模型,吸引开发者以低成本部署AI服务。
2. 国内云厂商的“军备竞赛”
- 华为云与硅基流动合作,基于昇腾云服务推出推理服务,支持企业级应用。
- 腾讯云TI平台提供“零代码部署”和限时免费体验,并融合百度独家安全算子增强模型可靠性。
- 阿里云、字节跳动火山引擎等也争相上线一键部署功能,简化开发流程。
二、竞争与法律冲突:开源模式挑战闭源霸权,数据争议暗流涌动
DeepSeek的崛起直接冲击了美国AI巨头的商业模式:
- OpenAI的“战略动摇”:CEO奥特曼罕见承认“闭源策略可能站在历史错误一边”,并紧急推出性能不及R1的o3-mini模型,试图挽回开发者。
- Anthropic的“酸葡萄”反应:其CEO呼吁加强芯片管制以遏制中国AI发展,被开源社区批评为“双标”。
- 法律博弈:微软曾指控DeepSeek“窃取数据”,但随即被反讽其自身使用《纽约时报》等未授权数据训练模型。双方均未提供实质证据,舆论认为这是商业竞争的舆论战。
三、技术颠覆:绕过CUDA生态,重构硬件竞争逻辑
DeepSeek的技术突破不仅体现在模型性能,更在于对硬件生态的重构:
- 挑战英伟达护城河:团队绕过CUDA软件层,直接使用底层GPU汇编语言在H800芯片上优化训练,成本仅557.6万美元。此举为AMD等竞争对手打开突破口,后者宣称其GPU运行R1模型速度更快。
- 国产替代加速:华为昇腾等企业借势推动CUDA替代方案,国产GPU生态逐步成型;厦门智能时代等企业加速布局AI培训与DeepSeek+应用探索。
四、市场反应:华尔街质疑巨头“烧钱策略”,中国创新环境再引热议
- 资本市场的震荡:DeepSeek模型成本仅600万美元的消息引发美股科技股暴跌,Meta、谷歌等千亿级AI投资计划遭质疑。
- 中国创新模式的胜利:吴恩达与英特尔前CEO Pat Gelsinger指出,DeepSeek在资源受限下的工程创造力证明“开放终将胜利”,并呼吁美国反思封闭生态的局限性。
热门跟贴