我们每天都在开门,却几乎从没认真想过为什么钥匙插进锁以后门不会自动打开。钥匙能顺利进入对应锁芯已经说明你拥有打开这扇门的凭据,但还需要握住钥匙转动它带动锁舌退出最后再推开门。
这一两秒放慢看会发现人类早在一把最普通门锁里留下了一种成熟系统设计,证明你有资格做一件事和真正让这件事发生从来不是同一件事。进入数字世界后我们越来越容易忘掉它。今儿咱就唠唠这事。
一把门锁里藏着四层结构。钥匙是凭据回答有没有进入机制的资格,但拿着钥匙不等于门已经打开,插进锁里也不等于门已经打开。只有当钥匙与锁条件匹配并随后发生明确机械动作,锁状态才真正改变。
拥有能力与决定使用能力之间本来就有距离,真正改变现实发生在这段距离之后。计算机系统发展很大程度在追求效率,追求少一步。输入密码希望立即登录,刷脸希望门立即打开,授权应用希望后续自动完成。
从体验看越来越方便,但一个清晰边界也在消失,证明你是谁很快变成你能做什么,你能做什么又很快变成那就替你做了。过去三十年这种压缩通常问题不大,因为大多数软件最终只是给人提供工具,在真正改变现实前往往还有个人坐在屏幕前点确认。
AI Agent出现后结构开始改变,机器不只是帮我们操作软件,开始替我们完成整条操作链。曾经被人类自然承担的最后动作正在无声消失。
设想一扇奇怪的门只要钥匙插进去门锁立即弹开,技术上能做到但直觉会觉得设计有问题。因为把钥匙放进锁里可能只是为了确认钥匙是否正确,也可能只是准备动作,不该天然等价于现在就把门打开。
钥匙描述能力,转动描述具体意图,锁舌退出是现实结果。能力意图与结果从来不是天然相等。那下转动承担了把我有资格转换为我现在明确要让这件事发生,这就是执行边界。现代数字安全很擅长回答身份和权限问题,用户名密码证明身份证书证明设备Token证明授权。
这时候问有没有权限意义不大,答案可能是有。Agent时代最危险错误往往不是越权而是完全合规做错一件事。真正该追问的是即将发生的这次执行在此刻对此对象以这些参数仍然应该发生吗?就像门锁,问题不只是你有没有钥匙而是现在要不要转动它。
过去软件通常停在钥匙之前,负责提供信息整理数据计算结果然后等人完成最后一步。AI Agent不同,它自己拆解任务自己找信息自己判断路径自己调用工具,如果权限允许还自己完成最终操作。
从效率看这是Agent最迷人的地方,但从控制结构看负责拿钥匙的人和负责转钥匙的人正变成同一个主体。当理解规划授权执行不断集中到同一Agent,我们做的不是简单地让软件更自动化,是在重新分配执行权。
钥匙与转动之间原本存在的距离正被自动化悄悄抹平。科技行业长期有种工程直觉,步骤越少延迟越低确认越少能自动完成就别让人再操作。在大量低风险场景这当然正确,问题在于我们很容易把减少不必要摩擦进一步理解成所有边界都是摩擦。
但现实世界不是这样,刹车是摩擦电梯安全检测是摩擦银行卡每日限额是摩擦危险设备保护盖也是摩擦。
它们目的不是提高效率,是确保某些动作不会因为前面条件已满足就不受约束一路走到底。真正该区分的是哪些步骤只是低价值流程,哪些步骤实际上承担边界。
流程能被自动化,边界不能因为自动化消失。提到执行边界很多人第一反应是不是每次AI操作前都要重新确认,并不是。
真正值得设计的不是更多人工审批,而是让系统能在最终执行前重新独立判断,执行对象是不是原来的对象,金额有没有超边界,环境有没有变化,策略此刻是否仍然有效,证据链是否完整,多个独立条件是否同时成立,有没有任何规则明确拒绝这次执行。
最后那下转钥匙未必需要人来完成,它完全可以高度自动化,但它应该是一套与拿到钥匙完全不同的机制。
自动执行不等于无边界执行。真正成熟的Agent系统甚至可能比人工操作更自动,但它依然会保留明确的执行控制层,在现实真正改变前还有最后一道机制只负责回答这一次是否真的允许发生。它不需要比AI更聪明,只需要拥有清晰权力在条件不成立时不让锁芯转过去。
钥匙证明拥有能力但门不会因此自动打开,在能够与发生之间始终还应该有最后一个问题,现在真的要转动它吗?AI Agent时代真正缺少的也许不是更聪明钥匙,而是重新找回那下看似多余实际上决定现实是否改变的转动。你觉得AI执行前该不该加道确认机制?评论区聊聊。
热门跟贴