打开网易新闻 查看精彩图片

千问办公的模型设置页面,除了Qwen 3.8 Max,已经看不到DeepSeek V4 Pro和GLM-5.3这两款外部模型了。

8月14号官宣接入,这才几天时间就悄悄撤掉,难免让人怀疑。难道是内部给了压力,不让接其它模型?又难道是千问办公接下来要深度捆绑自己的大模型,不接外部模型?

我觉得都不是。

首先,Qwen和外部模型竞争的确是事实。但千问办公撤不撤,DeepSeek、智谱都跟Qwen系列在竞争,改变不了结果。难道你撤掉了,人家模型进展就慢一点?可能性不太大。

其次,模型之间的gap在缩小,未来某一个模型全方位绝对领先的可能性不太大,哪怕Qwen也很难做到。更大可能性是,不同模型交替领先,我在这方面强一点,你在那方面强一点。所以,模型池策略一定是比单一模型更好,几个大汉打一个大汉,阿里不可能不清楚这一点。

而且,各种harness产品都在引入多模型,腾讯的WorkBuddy、字节的TRAE Work都内置了第三方大模型,DeepSeek刚推出的DeepSeek Harness也支持外部模型接入。千问办公如果不接其他模型,相当于自己给自己封印了,一个大汉去打几个大汉。阿里不可能这么傻。

所以我的感觉是,阿里不会撤掉DeepSeek V4 Pro和GLM-5.3,只是把它们隐藏起来了。什么意思呢,阿里要用外部模型来丰富自家产品的能力,但是,不想让用户知道。

你们留意到没有,千问办公的模型选择器跟腾讯字节的是不一样的。WorkBuddy、Trae Work的模型选择器页面,直接给用户提供模型型号,让用户去选。但千问办公只提供基础、经济、高级模式,把模型品牌、型号都给模糊处理了。官方的帮助文档里,也没有提供模型型号,只是模糊的说模型列表会持续更新。

我觉得这个做法,有点精。

第一,不给外部模型打广告导流。用户根本看不到模型品牌,所以任务完成的很好,用户只知道千问办公牛逼,而不是被第三方模型分走口碑。如果让用户清楚了解某个任务DeepSeek V4 Pro比Qwen 3.8 Max做的更好,那么下次再有同样任务需求,他会点名继续用,甚至可能绕过千问办公直接去用DeepSeek V4 Pro,稀释自家模型的流量。现在千问办公给所有模型隐藏起来,这会弱化第三方模型的品牌效应,强化千问办公的用户心智。

第二,模型路由后台分配,你不知道调用的是哪个模型,也不知道每个模型跑了多少词元,对于平台方,这样是最有利的。

第三,其实用户也不需要选。大部分用户,特别是计算机小白用户,搞不懂DeepSeek V4 Pro和Qwen 3.8 Max有什么区别,更不晓得哪个任务应该用哪个模型,所以你给用户去选,反而让人一头雾水。与其这样,还不如不让用户做选择,智能路由根据任务特点直接去调用模型。对用户来说,反正任务是跑完了。所以,不让用户做选择题,用户体验可能更好。

当然,这么做也有坏处。万一第三方模型拉垮了,导致用户的任务处理结果出错。那么用户只会把这笔账算到千问办公头上,因为他根本不知道用的是哪个模型,那这个锅也就只能千问办公来背了。

综合考虑,利一定是大于弊的。

那么新的问题来了,不想给外部模型导流的又何止阿里?腾讯字节百度面对的难道不是同样一道题么。这些大厂的AI办公产品和模型厂商之间是微妙的关系,既有合作,也在博弈。既需要用外部模型来丰富自身产品能力,又不想让自己的产品沦为模型厂商的配角,帮它们赚钱还给它们导流。

把外部模型全部塞进“基础、经济、高级”这三个档位里,让用户感知不到外部模型的存在,这对大厂才是最有利的。

所以你说,腾讯百度字节会不会也这么干?