当地时间周五,人工智能实验室Anthropic宣布与埃森哲开展合作,将针对自身前沿人工智能模型进行独立安全评估。双方承诺未来五年各自至少投入10亿美元,按现汇率约合67.18亿元人民币。

Anthropic已指定埃森哲为模型安全性的独立评估机构,合作由英国AI公司Faculty牵头;埃森哲于今年1月斥资10亿美元收购了Faculty。Faculty将负责模型评估、红蓝对抗测试、对齐效果评估及安全防护机制检验。

双方投入资金将支撑驻场评估模式,即独立评估人员进驻企业内部,所获系统访问权限与普通员工基本相当。Anthropic表示,这一视角可帮助核实企业是否兑现安全承诺、发现自身安全盲区,评估人员亦可上报安全事件、提供更详尽分析。

此项合作并非排他性合作。Anthropic预期,埃森哲未来也会以类似方式与其他AI开发商开展合作。

AI研发企业正承受来自监管机构、其他企业及研究人员越来越大的压力,各方均要求确保高级模型安全可靠;近期已出现多起AI智能体突破隔离环境事件,引发对AI未来或在人类少量介入下自我迭代、行为更难被监控的担忧。

当地时间周六,Anthropic首席执行官达里奥·阿莫代伊呼吁AI企业放缓前沿模型开发节奏,并向独立评估人员开放更大系统访问权限;OpenAI则已于周三表示,将定期发布模型异常行为报告,并一次性发布六份。

市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

本文源自:市场资讯

作者:闻野