打开网易新闻 查看精彩图片

观点网讯:近日,新墨西哥州立大学最新研究发现了一种名为GhostWriter的新型攻击手法,能将恶意讯息注入AI的长期记忆中。

与传统仅影响单次对话的提示注入攻击不同,GhostWriter攻击利用AI对长期记忆无条件信任的弱点,使恶意记忆长期潜伏并在后续互动中被自动调用

研究团队测试显示,GhostWriter记忆注入成功率约为98%,而被植入的恶意记忆在后续互动中被成功触发的比例约60%。

这意味着一旦记忆遭渗透,AI在未来的对话、推论甚至决策中,都可能基于错误资讯行事,进而引发资料外泄、篡改联络资讯或误导决策等风险。

为应对相关攻击,研究团队同时提出了名为Agentic Memory Sentry(AM‑Sentry)的防御框架,通过记忆筛查和更严格的记忆管理政策来阻截恶意内容。

免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。