马斯克的AI助手,也开始请Claude来干活了!
10月7日,马斯克在X上宣布,Grok Bot将根据具体任务选用最合适的后端模型,并直接点名Claude Opus 5.5、Midjourney和Suno。

他给出的标准简单直接:
哪个最有可能给你带来最好的结果,就用哪个。
谁好用,就用谁。

网友ExiledonMoon调侃,连马斯克的AI助手,也开始找Claude帮忙干活了。
另一位网友Token Maxxer则提醒:马斯克列出的名单还包括「其他领先的API」。OpenAI只是没有被点名,并未被明确排除。
这也留下了一个悬念:OpenAI的模型,会不会也成为Grok Bot的外援?
至少,Claude已经开始上岗。
据9to5Mac同日报道,Grok Bot已经可以使用Claude Opus 5.5。

你把任务交给马斯克的AI助手,背后干活的可能是Claude。
一边与Anthropic争夺用户,一边调用Claude,马斯克为什么愿意这样做?
借对手的模型争取自己的用户
从马斯克强调的「最佳结果」来看,他考虑得很实际:
先让Grok Bot把用户的活干好,不必让自家模型包办所有环节。
如果某项任务借助Claude能做得更好,接入它,就有机会减少用户因体验不佳而转向其他产品的情况。
更关键的是,即便背后干活的是Claude,用户交代需求、连接工具、跟进任务的地方,仍然可以是Grok Bot。
Anthropic提供部分模型能力,Grok Bot负责组织这些能力、交付结果。只要任务完成得好,用户就有理由继续使用这个助手。
因此,调用对手的模型,也可以成为争取用户的一种手段。
即使部分工作由Claude完成,用户下一次有任务,也可能先打开Grok Bot。
Grok Bot想接下的是一整件事
马斯克此次提到的Grok Bot,在8月11日推出Beta版。
这款智能助手自带云电脑,可以在上面替用户执行任务。
按照官方介绍,Bot可以使用工具、登录应用、跨软件处理工作;多个Bot还能相互沟通、分享任务背景,分工协作。
用户离开电脑后,工作也能继续。

多个Grok Bot交接任务、汇报进展。
此次马斯克提到了Grok Bot,不等于X上的Grok聊天功能也要全面换用Claude。
除了Claude,名单中还有图像生成工具Midjourney和音乐生成工具Suno,横跨了文字、图像和音乐,对应的是一个很实际的需求:完成一整件事,往往需要几种能力配合。
比如做一条短视频,要写文案、准备封面,还要配上一段音乐。
找几个AI帮忙,素材可能很快就有了。但解释要求、搬运文件、协调修改,往往还得你在不同窗口之间来回处理。
如果Grok Bot能根据任务调用合适的模型,把这些环节衔接起来,就有机会替你接下部分协调工作。
用户想要的很简单:少在几个模型和工具之间来回切换,同一个需求不用解释好几遍。
连选哪个模型也想替你省了
模型接得越多,会不会反而让用户犯起「选择困难症」?
打开助手,还得先想一遍:写代码该用Claude还是Grok?做图又该换哪个工具?
Grok Bot的官方文档,已经给出了设计思路:
模型选择由平台管理,没有面向用户的模型选择菜单,实际使用的模型组合也可能随时间变化。
换句话说,你交代任务,系统替你选模型。
你不必为了写一段代码,先研究谁最近升级了;也不用为了做一张图,翻遍各家工具的能力清单。
不过,这不代表用户不需要知道用了什么、花了多少。
官方文档提到,用量分析会显示实际用了哪个模型,费用也按所用模型计算。
这些信息能帮助用户了解钱花在哪里,判断这次任务是否划算。
让AI选模型到底靠不靠谱?
把选择交给系统之后,问题来了:让AI替人选模型,有什么优势,这样的选择又靠不靠谱?
让一个模型给其他模型分配工作,已经有了先例。
早在2023年,HuggingGPT就尝试让ChatGPT拆解用户任务,根据Hugging Face上的模型介绍挑选合适的模型,再由系统调用这些模��执行任务、汇总结果。
OpenAI最近开放公测的Decisions API,也为这类选择提供了工具。

开发者给出任务信息和候选选项,由GPT-6 Luna返回判断,再让应用根据判断执行下一步。
用在多模型助手里,它就可以辅助决定:当前任务该交给哪个模型。
自动选择的优势,尤其体现在一项工作需要反复调用模型的时候。
简单的信息整理、复杂的推理、最后的文字润色,对模型能力的要求并不一样。系统如果能逐步判断,就有机会把更强、更贵的模型用在真正需要它的环节。
这类做法,已有研究验证了成本上的收益。
2024年的RouteLLM研究显示,在MT-Bench评测中,通过在GPT-4和Mixtral之间分配请求,系统可以在达到约95%的GPT-4评测表现时,相比全部使用GPT-4降低超过85%的成本。

RouteLLM在MT-Bench中的模型分配效果。
但这项结果比较的是自动分配与固定使用GPT-4,不能完全证明AI比人更会选模型,也不能等同于Grok Bot的实测成绩,Grok Bot具体如何选择模型,还需要更多公开信息才能判断。
而且,「合适」没有一个适用于所有人的答案。
有人赶时间,有人想省钱,也有人愿意多花一些时间和费用,换取更好的结果。同样是生成图片,一张临时配图和一组能直接发布的海报,完成标准就不一样。
AI助手得先弄清这些要求,再决定调用哪些能力。否则,模型再强,也可能做不出用户想要的结果。
对用户来说,自动选择到底能不能省心,还得把检查、修改和返工的时间一起算进去。
谁能成为用户的第一选择?
这场竞争里,还有刚刚推出Dots的OpenAI。
9月29日,OpenAI发布全天候智能体Dots,同样自带云电脑,可以连接应用,在用户离开后继续推进工作。

Dots根据新要求修改发布素材。
它与Grok Bot争夺的,是同一个机会:成为用户愿意长期把任务交给它的AI助手。
但助手之间的竞争,也可能与模型调用上的合作同时存在。
假如未来Grok Bot接入OpenAI模型,用户就可能把任务交给马斯克的助手,再由OpenAI的模型完成其中一部分工作。OpenAI提供模型能力,两家的助手仍然继续争取用户。
目前,这还只是可能性。马斯克此次明确点名了Claude,尚未确认是否接入OpenAI模型。
当不同助手有机会调用相近甚至相同的模型,谁更理解用户、谁能接着完成上一次的工作,就可能成为影响选择的关键。
如果一个助手已经知道你的文案偏好、图片风格,也能找到之前的文件,下一次有任务时,你自然更容易先想到它。
换用其他助手,则可能意味着重新交代背景、连接工具,再磨合一遍工作方式。
接入Claude,为Grok Bot增加了可调用的模型能力。
接下来,这些能力还要转化成用户能感受到的好处:
需求变了,能不能接着改;工作做到一半,能不能继续推进;交来的结果,还需要用户花多少功夫来收尾……
这些体验,都会影响到用户下一次把任务交给谁。
参考资料:
https://x.com/testingcatalog/status/2107803665457189061
https://x.com/elonmusk/status/2107724314451878104
https://www.theinformation.com/briefings/musk-says-spacex-will-sometimes-use-rival-models-power-grok-bot
https://developers.openai.com/api/docs/guides/decisions?utm_source=chatgpt.com
本文来自微信公众号 “新智元”(ID:AI_era),作者:ASI启示录;编辑:元宇,36氪经授权发布。