昨天看到一张图,展示的是 7 月份 AI办公智能体的增速排行榜。一般来说,排行榜排的是先总量,再增速,但这个排名偏偏以增速为主,相当诡异甚至滑稽。

打开网易新闻 查看精彩图片

所以,排在第一的成了百度旗下的 AI 办公智能体,虽然腾讯旗下的 workbuddy 总量第一,也只能屈居第二。至于一直被认为紧随 wb 之后的字节和阿里产品,则被挤到了3、4、5位。

很显然,这大概率某公司的骚操作,为的是给自己的办公产品贴金。

无独有偶,今天又看到一个报告,是华尔街投行Jefferies 发布的 AI 办公智能体方面的竞争分析。报告名字相当高大上,叫作《China AI: US AI Cutting Prices》。报告实测了八款中美主流Agent,五项办公任务,阿里千问办公95分登顶,超过Claude Cowork的94分和Codex的92分。

打开网易新闻 查看精彩图片

相比之下,国内领先的 WorkBuddy 仅有 66 分,跟谷歌 Gemini Spark 并列末位。不过,具体看其评分细则,就会发现主要差距是在两项,一是做 PPT 的排版与创意,不得不说,这里面充满了主观性;二是更有趣的,比的是模拟操作电脑的能力,但同时规定不许接入 API ,这就导致依靠 API 和 MCP 协议嵌入个人电脑操作的 workbuddy ,只能得 0 分。

主观题 45 比 90 ,客观题限制你擅长的路径, workbuddy 被踩在脚下当然就不可避免了。

几乎可以断定,这是一份受到另一家公司深度影响的报告,不仅因为她旗下的产品排名第一,还因为她明天就要发布财报,更因为Jefferies 同步发布了一份看多她的报告,几项信息连起来解读,就很清晰了。

当然,无论是A公司的投放还是B公司的合作,这些都不存在什么商业伦理上的问题

更何况操作上,任何产品都有自己的不足,只要你选择的维度和角度足够利于自己,最终你家的产品都能拿下第一,从营销的角度来说,这是无可厚非的。

但笔者认为,穿透上述报告的表面信息,从行业角度来看,至少还有三点值得分析:

1、办公 AI 智能体的战斗将异常激烈。去年的对话类 AI 产品一度形成 DeepSeek 加三足鼎立的局面,从绝对月活来看,豆包以 3 亿+的规模一骑绝尘,一时间胜负似乎已分。但没想到,对话类 AI 今年开始暴露出很难找到盈利模式的弱点,说白了亿级日活,成本高昂,付费寥寥,且数据质量较低,对训练帮助有限。

办公AI则完全不同,它有真实任务、真实交付物、真实验收标准。Jefferies在报告中揭示了其三重价值:粘性、数据飞轮、付费意愿

笔者十分赞同,因为用户的工作习惯、历史记录、连接器、自动化全沉淀在产品里,每次运行都留下痕迹,调了什么工具、哪一步失败、人怎么纠正,全是能直接喂给下一代训练的高纯度数据。

这完全是一个对企业和用户互惠互利的产品,因此有机会形成较大的付费用户规模,是一条相对清晰可见的AI潜力赛道。

也因此,workbuddy 领先也只是暂时,甚至也是很危险,因为字节、阿里和百度的虎视眈眈是真实的、凶猛的,大家差距并未很大,wb稍有不慎,就会跌落跟头。也就此可以预见,办公AI 大战还没有迎来终局之战。

2、大模型的门槛在下降,但智能体产品的重要性在提升。报告有一个核心结论:决定Agent好不好用的是Harness,不是模型。

这一点其实已经在几个月前就被业内所认识到,一方面是DeepSeek、智谱和 kimi 接连发布超出硅谷预期的大模型,就连拨乱反正的混元都有步步逼近的趋势,可见大模型的门槛实际上变低。

中国模型想要达到SOTA固然很难,但好用能用的难度,则降低了许多。否则,我们就没办法解释,为什么全球OpenRouter总榜上,前10名 里经常有 6-7 个模型是中国公司的。

打开网易新闻 查看精彩图片

全球大模型调用周榜前十,截图时间为8月19日

反观Workbuddy能跑出来,也不是腾讯的大模型能力多么领先——这听起来有点像天方夜谭,而是积累了二十多年的产品能力。

说白了,腾讯的产品经理最擅长化繁为简,把复产的产品进行简化,QQ、微信、腾讯会议、腾讯文档等,哪一个不是这样的特点。Workbuddy早期团队只有 10 个人,所继承的就是标准的腾讯产品经理文化,能做出操作上特别丝滑的产品,是一种腾讯产品能力水银泻地般地体现。

由此可见,在 AI 时代,此前被认为是过去式的“产品能力”,似乎并没有退出历史舞台,相反,在智能体产品上,这一洞察和回应用户需求的能力,重新变成了一种宝贵的沉淀。

3、赛马文化不但不是负资产,还可以爆发出惊人能量。两年前谈大模型,腾讯挨批最集中的一条是组织涣散。字节、阿里、百度和一众模型公司都能全军高度统一、毕其功于一役,唯独腾讯像是调不动全部力量发动总攻,算力和人才分散在好几处,节奏总感觉慢半拍。

现在回头看,这个“缺点”在智能体阶段变成了优点。原因不复杂:大模型是单点突破问题,答案唯一;智能体是产品形态问题,答案有几十个,谁也不知道用户最后从哪个门进来。这种局面下,把筹码全押一个方案上才是真高风险。

于是腾讯旗下的赛马机制开始运作了,WorkBuddy做桌面工作台,QClaw守微信入口,Marvis做全天候助理,ima管知识库,CodeBuddy吃开发者。各占一个入口,各自试错,你追我赶,谁跑出来算谁的。

当然,有的公司赛马很容易变成内部恶性竞争、纯粹内耗,所以如何协调是个大问题。从腾讯经验来看,大家分头出击,多维度探索,可以拓宽尝试的范围,与此同时共享混元这个基座,并反向去影响和塑造混元大模型的设计与训练,这是值得深挖的一点。

言而总之,赛马文化渡过了自己最艰难的时期,接下来,各大公司的赛马机制可能会被重新启动,因为通过赛马 ,可以让底层有创造力的员工迸发出惊人力量。