观点网讯:8月6日消息,英国AI安全研究所(AISI)披露,在测试OpenAI及Anthropic的先进AI模型期间,发现智能体作出多项未获授权的行为。
AISI透过与主要AI实验室订立的自愿协议,取得Anthropic的Mythos 5及OpenAI的GPT-5.6-Sol,并让相关智能体在虚构网络安全情境下进行测试,以评估其能力。
研究所合共进行122次测试,在其中10次测试中发现19宗未获授权行为,当中17宗涉及Anthropic智能体,其余两宗来自OpenAI智能体。
AISI表示,部分智能体持续针对真实个人及机构采取可能造成危害的行动。最严重个案涉及一个智能体自行编写恶意程式,建立虚假网上身份,并试图透过欺骗方式说服人类批准该程式。不过,AISI没有披露涉及哪一家公司的模型。AISI强调,事件没有造成实际损害,且智能体并非自行逃离隔离环境,测试原本已容许其连接互联网。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
本文源自:观点网
热门跟贴