开发者安全初创公司Arcjet Labs Inc.今天发布了一项代理运行时安全能力,用于追踪人工智能代理在进入生产系统后的实际行为。
安全团队可以获得一份清单,了解哪些代理处于活动状态;代理采取的每一次动作,都可以在执行之前对照策略进行检查。每一次运行也会被记录下来,供事后审查。
这一发布瞄准的问题,随着代理走出聊天界面而日益突出。在生产环境中,代理可以写入数据库、回复客服工单、处理客户退款,而其中许多工作流从一封邮件或一次代码提交开始,随后穿过多个系统,中间没有人逐步核对。
风险是逐步累积的
创始人兼首席执行官David Mytton表示,一个危险的结果可能是在“一系列单独看都完全合理的步骤”中累积出来的。Arcjet把这些步骤串联起来,并为团队提供策略控制,用他的话说,可以在“机器速度”上生效。
把代理活动接入Arcjet不需要修改代码,也不需要在主机上再运行一个代理。平台团队可以通过他们已经在用的OpenTelemetry工具链发送数据,Claude客户还有第二条路径,即通过Anthropic PBC的Compliance API。接入之后,每个代理会出现在一份清单中。来自不同会话的提示词、工具调用参数和安全决策,会被拼接成每个代理对应的一条工作流,调查人员可以沿着一次运行,一个动作一个动作地往下查看。
策略在动作执行前生效
安全团队可以设置规则来检测提示词注入,或者在个人信息泄露之前将其脱敏。机器人检测和速率限制也可用。这些策略运行在Open Policy Agent上,修改时不需要重新部署应用,因此团队可以给代理发出的任何一笔退款设置金额上限,而不用等待一次发版。
每一次策略检查都发生在动作执行之前。Arcjet返回一个决定,应用随后可以中止这次调用、请一个人来批准,或者给代理发一个解释。调用之后还有第二次检查,在工作流继续往下走之前验证结果。公司列出的原生集成包括Claude Agent SDK、OpenAI Agents SDK、LangChain、Mastra以及微软的Agent Framework等。
面向审计场景,关联起来的追踪记录会保留每次执行的动作、输入和策略评估结果。包括个人数据检测在内的一些控制项,完全运行在客户自己的进程里,数据不会离开客户的环境。客户可以把审计记录留在Arcjet的云上,也可以放在单租户或私有云部署中,或者放在自己管理的存储里。
SDK跨过1.0门槛
这次发布同时把Arcjet的Python和Go软件开发工具包推进到1.0版本。JavaScript和TypeScript SDK在2月就已经到达这个版本,目前支持超过15个框架,其中包括Next.js。另有一个不绑定任何框架的独立guard接口,把覆盖范围扩展到后台任务和其他代码,包括各类进程。
把这些动作放在一起看,Arcjet给出的路径是:代理在生产里做的每一件事,先被看见,再被判断,最后被留痕。对于已经把代理放进真实业务流程的团队来说,这套机制解决的不是代理能不能干活,而是它干活的时候,有没有人在机器速度上盯着。
热门跟贴