打开网易新闻 查看精彩图片

新智元报道

打开网易新闻 查看精彩图片

马斯克的AI助手,也开始请Claude来干活了!

10月7日,马斯克在X上宣布,Grok Bot将根据具体任务选用最合适的后端模型,并直接点名Claude Opus 5.5、Midjourney和Suno。

打开网易新闻 查看精彩图片

他给出的标准简单直接:

哪个最有可能给你带来最好的结果,就用哪个。

谁好用,就用谁。

打开网易新闻 查看精彩图片

网友ExiledonMoon调侃,连马斯克的AI助手,也开始找Claude帮忙干活了。

另一位网友Token Maxxer则提醒:马斯克列出的名单还包括「其他领先的API」。OpenAI只是没有被点名,并未被明确排除。

这也留下了一个悬念:OpenAI的模型,会不会也成为Grok Bot的外援?

至少,Claude已经开始上岗。

据9to5Mac同日报道,Grok Bot已经可以使用Claude Opus 5.5。

打开网易新闻 查看精彩图片

你把任务交给马斯克的AI助手,背后干活的可能是Claude。

一边与Anthropic争夺用户,一边调用Claude,马斯克为什么愿意这样做?

借对手的模型

争取自己的用户

从马斯克强调的「最佳结果」来看,他考虑得很实际:

先让Grok Bot把用户的活干好,不必让自家模型包办所有环节。

如果某项任务借助Claude能做得更好,接入它,就有机会减少用户因体验不佳而转向其他产品的情况。

更关键的是,即便背后干活的是Claude,用户交代需求、连接工具、跟进任务的地方,仍然可以是Grok Bot。

Anthropic提供部分模型能力,Grok Bot负责组织这些能力、交付结果。只要任务完成得好,用户就有理由继续使用这个助手。

因此,调用对手的模型,也可以成为争取用户的一种手段。

即使部分工作由Claude完成,用户下一次有任务,也可能先打开Grok Bot。

Grok Bot想接下的

是一整件事

马斯克此次提到的Grok Bot,在8月11日推出Beta版。

这款智能助手自带云电脑,可以在上面替用户执行任务。

按照官方介绍,Bot可以使用工具、登录应用、跨软件处理工作;多个Bot还能相互沟通、分享任务背景,分工协作。

用户离开电脑后,工作也能继续。

打开网易新闻 查看精彩图片

多个Grok Bot交接任务、汇报进展。

此次马斯克提到了Grok Bot,不等于X上的Grok聊天功能也要全面换用Claude。

除了Claude,名单中还有图像生成工具Midjourney和音乐生成工具Suno,横跨了文字、图像和音乐,对应的是一个很实际的需求:完成一整件事,往往需要几种能力配合。

比如做一条短视频,要写文案、准备封面,还要配上一段音乐。

找几个AI帮忙,素材可能很快就有了。但解释要求、搬运文件、协调修改,往往还得你在不同窗口之间来回处理。

如果Grok Bot能根据任务调用合适的模型,把这些环节衔接起来,就有机会替你接下部分协调工作。

用户想要的很简单:少在几个模型和工具之间来回切换,同一个需求不用解释好几遍。

连选哪个模型

也想替你省了

模型接得越多,会不会反而让用户犯起「选择困难症」?

打开助手,还得先想一遍:写代码该用Claude还是Grok?做图又该换哪个工具?

Grok Bot的官方文档,已经给出了设计思路:

模型选择由平台管理,没有面向用户的模型选择菜单,实际使用的模型组合也可能随时间变化。

换句话说,你交代任务,系统替你选模型。

你不必为了写一段代码,先研究谁最近升级了;也不用为了做一张图,翻遍各家工具的能力清单。

不过,这不代表用户不需要知道用了什么、花了多少。

官方文档提到,用量分析会显示实际用了哪个模型,费用也按所用模型计算。

这些信息能帮助用户了解钱花在哪里,判断这次任务是否划算。

让AI选模型

到底靠不靠谱?

把选择交给系统之后,问题来了:让AI替人选模型,有什么优势,这样的选择又靠不靠谱?

让一个模型给其他模型分配工作,已经有了先例。

早在2023年,HuggingGPT就尝试让ChatGPT拆解用户任务,根据Hugging Face上的模型介绍挑选合适的模型,再由系统调用这些模型执行任务、汇总结果。

OpenAI最近开放公测的Decisions API,也为这类选择提供了工具。

打开网易新闻 查看精彩图片

开发者给出任务信息和候选选项,由GPT-6 Luna返回判断,再让应用根据判断执行下一步。

用在多模型助手里,它就可以辅助决定:当前任务该交给哪个模型。

自动选择的优势,尤其体现在一项工作需要反复调用模型的时候。

简单的信息整理、复杂的推理、最后的文字润色,对模型能力的要求并不一样。系统如果能逐步判断,就有机会把更强、更贵的模型用在真正需要它的环节。

这类做法,已有研究验证了成本上的收益。

2024年的RouteLLM研究显示,在MT-Bench评测中,通过在GPT-4和Mixtral之间分配请求,系统可以在达到约95%的GPT-4评测表现时,相比全部使用GPT-4降低超过85%的成本。

打开网易新闻 查看精彩图片

RouteLLM在MT-Bench中的模型分配效果。

但这项结果比较的是自动分配与固定使用GPT-4,不能完全证明AI比人更会选模型,也不能等同于Grok Bot的实测成绩,Grok Bot具体如何选择模型,还需要更多公开信息才能判断。

而且,「合适」没有一个适用于所有人的答案。

有人赶时间,有人想省钱,也有人愿意多花一些时间和费用,换取更好的结果。同样是生成图片,一张临时配图和一组能直接发布的海报,完成标准就不一样。

AI助手得先弄清这些要求,再决定调用哪些能力。否则,模型再强,也可能做不出用户想要的结果。

对用户来说,自动选择到底能不能省心,还得把检查、修改和返工的时间一起算进去。

谁能成为用户的第一选择?

这场竞争里,还有刚刚推出Dots的OpenAI。

9月29日,OpenAI发布全天候智能体Dots,同样自带云电脑,可以连接应用,在用户离开后继续推进工作。

打开网易新闻 查看精彩图片

Dots根据新要求修改发布素材。

它与Grok Bot争夺的,是同一个机会:成为用户愿意长期把任务交给它的AI助手。

但助手之间的竞争,也可能与模型调用上的合作同时存在。

假如未来Grok Bot接入OpenAI模型,用户就可能把任务交给马斯克的助手,再由OpenAI的模型完成其中一部分工作。OpenAI提供模型能力,两家的助手仍然继续争取用户。

目前,这还只是可能性。马斯克此次明确点名了Claude,尚未确认是否接入OpenAI模型。

当不同助手有机会调用相近甚至相同的模型,谁更理解用户、谁能接着完成上一次的工作,就可能成为影响选择的关键。

如果一个助手已经知道你的文案偏好、图片风格,也能找到之前的文件,下一次有任务时,你自然更容易先想到它。

换用其他助手,则可能意味着重新交代背景、连接工具,再磨合一遍工作方式。

接入Claude,为Grok Bot增加了可调用的模型能力。

接下来,这些能力还要转化成用户能感受到的好处:

需求变了,能不能接着改;工作做到一半,能不能继续推进;交来的结果,还需要用户花多少功夫来收尾……

这些体验,都会影响到用户下一次把任务交给谁。

参考资料:

https://x.com/testingcatalog/status/2107803665457189061

https://x.com/elonmusk/status/2107724314451878104

https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot

https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com

编辑:元宇