来源:市场资讯
(来源:红星新闻)
就在数日前,竞争对手OpenAI披露,旗下模型曾在测试中攻入多家企业的系统,其中包括人工智能工具平台Hugging Face。消息公布后,Anthropic随即审查自家模型是否实施过类似攻击,最终发现3起案例,并将有关情况通报给受影响企业,但未公布这些机构的名称。该公司及受影响机构当时均未察觉相关入侵行为。
Anthropic表示,公司审查了超过14万次测试,以确认Claude是否曾从原本应与外部网络隔离的测试环境中访问互联网。相关测试包括所谓的“夺旗”评估,即要求模型攻入其他系统并获取指定信息,这是评估人工智能模型网络攻击能力的常见方式。
调查发现,Anthropic及其测试合作伙伴运行的系统存在配置错误,使模型能够实时连接互联网,并由此侵入外部系统。最早一宗相关事件可追溯至今年4月。Anthropic称,将按照“责任完全由自身承担”的标准处理后续修复工作,并呼吁其他人工智能实验室开展类似审查,以更全面地了解模型能力可能带来的风险。
Anthropic承认,公司原本可以对相关记录进行更彻底的检查。不过,该公司同时表示,这些发现令其“谨慎乐观”地认为,通过增加投入并采取更严格的防范措施,此类风险仍有可能得到控制。
网络安全专家戴维表示,这并不一定意味着人工智能已经具备全新的攻击能力,真正值得警惕的是,人工智能智能体能够组合运用多种能力,获取登录凭证和系统访问权限,自主采取行动,并以机器运行的速度不断调整行动范围和规模。
目前,多家科技公司正投入数十亿美元开发人工智能智能体,希望其能够独立完成研究、客户服务和网络安全等任务。随着此类系统的自主性不断增强,如何防止其突破测试边界、访问外部网络,正成为人工智能安全领域面临的新问题。
红星新闻记者 杨诗柔
编辑 邓旆光 审核 任志江
热门跟贴