Uber、Pinterest、Stripe、Coinbase、Ramp和AT&T,这些名字放在一起,通常意味着竞争。但最近它们站在了同一边——集体从专有模型转向开源模型,省下了一大笔AI开支。
这不是某一家公司的孤例,而是正在大科技和初创公司中蔓延的新趋势。核心动作是“智能模型路由”:不再让所有请求都涌向同一个昂贵的大模型,而是根据任务难度,动态分配给不同模型处理。
打开网易新闻 查看精彩图片
省钱逻辑:按需分配
简单任务交给轻量开源模型,复杂任务才动用顶级专有模型。这套路由策略让这些公司在保持AI能力的同时,显著压缩了推理成本。对AI账单敏感的企业来说,这笔账算得过来。
开源模型在过去一年里的能力跃升,是这波迁移的底气。当开源模型在多数日常任务上已经够用,为“过剩能力”持续付费就不再是理性选择。
趋势信号:成本压力倒逼务实
这波迁移也折射出行业心态的变化:AI叙事从“秀肌肉”转向“算利润”。当增长故事讲完,CFO们开始盯着每百万token的单价。开源模型+智能路由,成了控制成本最直接的手段之一。
对模型厂商而言,这无疑是个警示:如果闭源模型的溢价无法对应实际效果差距,客户会用脚投票。这场由账单驱动的迁移,可能才刚刚开始。
热门跟贴