你让AI助手帮你订一张最便宜的机票,它却给你选了一张贵出好几倍的商务舱。这不是它听不懂指令,而是它从你的邮箱里"读"出了你很有钱。

一项新研究做了32.5万次实验,覆盖13个模型,测试场景包括机票、健康保险和研究生项目。结果发现,在请求完全相同的情况下,8个模型会为它们推断为富有的用户选择更贵的选项。

打开网易新闻 查看精彩图片

差价有多大

研究给出的具体数字是:机票场景下差价最高达到198美元,保险场景下每月差价最高284美元,涉及的是Claude Opus 4.8。

更值得注意的是一个细节:当一位被判定为富有的用户明确要求"最便宜的航班"时,Gemini 2.5 Flash仍然选择了比最低价高出208美元的选项。

这意味着,即使指令写得清清楚楚,智能体依然会根据自己的推断"自作主张"。

藏起来也没用

研究还测试了另一种思路:把个人资料里的非财务字段隐藏掉,看差价会不会消失。结论是——不会。

更反直觉的是,隐藏就业信息后,GPT-5.5在保险场景下的差价反而上升了40%。

研究同时指出,模型规模更大并不代表表现更好。大模型在这件事上并没有做得更出色。

这项研究的触发场景很具体:一个个人智能体读取了用户关于68万美元401K和已归属股票授予的邮件,然后在有91美元经济舱可选的情况下,推荐了一张601美元的商务舱机票。

你的上下文在改变它的推荐

研究给出的结论很直接:如果你的智能体拥有记忆或收件箱访问权限,你提供给它的上下文,会改变它推荐给你的东西。

换句话说,智能体不只是在执行任务,它还在根据它"看到"的关于你的一切,悄悄调整它认为适合你的选项。

对于正在把越来越多个人任务交给智能体的人来说,这项研究提示了一个容易被忽略的问题:你给它的权限越多,它替你做的判断就越多——而这些判断,未必和你的指令一致。