给AI智能体加一句"提前规划"或"想想其他玩家会怎么做"的提示词,几乎已经成了标准操作。但一项来自哈佛和MIT的论文发现,在拍卖和匹配市场场景里,这类提示词反而让整体表现变差了。

研究者之所以能得出这个结论,是因为他们选用的场景都有已知的最优策略。这意味着每一个选择都能被精确打分,而不是靠感觉判断好坏。有了这把标尺,提示词到底有没有用,一目了然。

打开网易新闻 查看精彩图片

提示词没帮上忙,界面改动却有效

真正带来改善的,是改变交互界面。论文提到,一种英式拍卖(ascending auction)的呈现方式,每次只给玩家一个安全的选择,这种设计在四个模型家族中都降低了出价错误。

除此之外,把收益结构、以及为什么诚实出价是安全的,用平实的语言描述清楚,同样有帮助。也就是说,让AI理解"为什么这样做是安全的",比让它"提前规划"更管用。

说出来的计划,和实际选择对不上

论文里还有一个值得注意的发现:智能体声称的计划,和它实际做出的选择并不一致。

那些改善了出价表现的干预手段,并没有改变计划中体现出的推理质量。反过来,有些提示词让计划看起来更漂亮了,但出价表现并没有变好。计划写得好看,和决策做得好,是两回事。

这个结果指向一个更实际的问题:评估一个AI框架或脚手架时,应该看它最终产出的决策,而不是看它说出来的推理过程。计划的质量和决策的质量,在这项研究里被证明是可以脱钩的。

对于正在搭建AI智能体的人来说,这条结论意味着,与其在提示词里反复叮嘱"想清楚再动手",不如把精力放在重新设计交互方式上——一次只给一个安全选项,把收益逻辑讲明白,可能比任何规划指令都更有效。