上周二,我差点把一个跳过链接发到虚空里。智能体从一张静态模型图里猜出了三个地标,而我握着批准点击的权限。结账流程距离消失只差一个跳过操作。发布之后我还能撤销这次重写吗?不能。那条缺失的逆向路径,就是整件事的核心。

这不是一篇讨论该不该信任模型的文章。这是一个具体的决策场景,而我是这个决策的负责人。后果是键盘用户可能直接跳过付款环节。可逆性必须在点击批准之前就存在。视觉布局只是一张海报,地标才是真正的路径。一个模型凭什么从像素里开辟出这条路径?

从零开始的关卡:先写决策卡

我现在对任何智能体重写导航的操作,都先跑一道从零开始的关卡。把这篇当作一份教程提案,不是一份完成的研究。每个阶段都有命令和检查项。检查不过,就停。不要跟一个空槽位讨价还价。

在打开模型之前,我拒绝动手,除非决策卡已经写好。这张卡故意写得很枯燥。枯燥的卡才能拦住那些花哨的猜测。把它存成 gate/decision-card.json

卡里写清楚几件事:决策是批准推断出的地标,负责人是当值设计主管,智能体的动作是重写地标和跳过链接,出错后果是屏幕阅读器和键盘用户跳过结账,可逆方式是依据审查记录恢复原始地图。证据要求包括原始地标图、提议地标图、跳过路径记录和主任务成功记录。空槽位阻止批准,假设不算证据。

验证方式很简单:把文件读出来。你能一口气说出负责人是谁吗?能说出伤害是什么吗?能说出恢复手段吗?如果任何一个答案开始变得像诗,就重写这张卡。不要继续。诗意不是控制手段。

只画人类点击的那一步

我画的是人必须做决定的那一刻,不是模型内部循环。智能体可以起草,但发布权仍然在人手里。实际流程是这样的:智能体提出地标重写,先检查证据文件是否完整。不完整就扣住发布,把空槽位亮出来。完整的话,人跑一遍跳过路径演练。主任务能不能在两次跳过内到达?不能就拒绝,保留原始地图。能就带着恢复手段批准。被丢弃的推断写进审查记录。

验证方法:把手指放在那个阻止发布的菱形判断上。如果你的图里没有停止点,你画的是一条流水线。流水线保护不了结账流程。你会上一辆没有刹车杆的火车吗?

写两个场景,不是十个

我把研究范围压得很小,这样关卡才诚实。场景A是已验证的跳过路径,场景B是推断出的页脚。两个都放在 gate/scenarios.md 里。这个文件就是协议本身,不是演示文稿。

场景A的任务是从文章正文到达结账。成功标准是两次跳过、焦点可见、朗读名称与标签一致。如果落点不是结账或主区域,就停。场景B的任务是智能体重写地标后完成同样的购买。如果提议的地图丢掉了原始主目标,就停。需要忽略的噪音是额外的装饰性内容。

这套关卡的价值不在模型表现有多好,而在人能不能在批准之前说清楚:错了会怎样,怎么退回来。三个地标、一个跳过链接、一次批准点击,看起来是很小的改动。但结账流程的消失,往往就是从这种小改动开始的。