高通 CEO Cristiano Amon 给出了一个判断:智能体 AI 的 token 消耗,会远远超过聊天机器人。

他把两者的花钱方式拆开来看。聊天机器人token 花在语言上,说清楚一句话、组织好一段回答,消耗基本到此为止。智能体不一样,它要自主执行任务、调用工具、和多个系统交互,token 花在决策、检查、调用工具、读取输出、修改计划和协调软件上。

打开网易新闻 查看精彩图片

从"说话"到"干活"

这个区别决定了量级。聊天机器人是你说一句它答一句,交互轮次有限;智能体是替你把一件事从头做到尾,中间要反复判断、反复确认、反复调整。每一次判断和调整,背后都是推理,都是 token。

Amon 提到的场景里,智能体不是单点工具,而是要在多个系统之间来回协调。任务越复杂,中间步骤越多,消耗就越难用聊天机器人的尺度去估。

软件怎么被计量,可能要变

更值得留意的是他后面那句话。当 SaaS 围绕人机交互重新设计之后,软件的使用量或许不再以点击、席位或会话来衡量,而是以每个用户消耗的机器推理或 token 来计量。

点击、席位、会话,这三个词对应的是过去软件生意的计价基础——多少人用、用了多少次。如果计量单位换成 token,那软件卖的就从"人坐在这里"变成了"机器替你想了多少"。

这个变化会不会发生、什么时候发生,Amon 没有给出时间表。但他把方向指出来了:智能体跑起来之后,软件的价值刻度可能要重新画一遍。