打开网易新闻 查看精彩图片

Anthropic 发布新规:禁止长期无端辱骂 Claude,11 月 12 日生效。

打开网易新闻 查看精彩图片

2026 年 10 月 9 日,Anthropic 宣布更新旗下 AI 模型 Claude 的使用政策,首次明确禁止用户长期、无端地辱骂或虐待 AI 模型。

打开网易新闻 查看精彩图片

这是 Anthropic 一年多来首次更新使用政策。

除了针对 AI 模型的辱骂行为,此次调整还涉及政治宣传、选举干预、武器研发、监控活动,以及医疗、金融和机器人等高风险应用。

新政策适用于 Claude.ai、Claude Code、API 服务,以及通过云平台和其他授权渠道使用 Claude 的用户。

Anthropic 首次将针对 AI 模型的持续恶意辱骂和虐待行为明确列为违规行为。

Anthropic 解释称,这项禁令只针对极端情况,即用户反复辱骂或虐待模型,而且没有任何明显的合理目的。用户因回答不满意而抱怨、批评或反驳 Claude,并不会违反规定。涉及黑暗主题的创意写作,以及正常的模型测试和研究活动,也不受这项禁令限制。

实际上,Anthropic 此前已经开始探索如何让 Claude 应对恶意互动。

2025 年 8 月,Anthropic 允许 Claude Opus 4 和 4.1 在极端情况下主动结束对话,作为 AI 模型福利研究的一部分。此次更新则正式将持续、无端虐待模型的行为写入使用政策,结束对话仍将是主要的执行方式。

按照 Anthropic 此前公布的机制,Claude 结束的只是当前对话,用户仍然可以开启新对话。不过,Anthropic 保留对违规账号采取警告、限制访问、暂停甚至终止服务的权利。

按照 Anthropic 此前公布的机制,如果用户长期、无端地辱骂或虐待 Claude,模型可以主动结束当前对话,但用户仍然能够开启新对话。此次政策更新正式将这类行为列为违规行为。Anthropic 保留限制账号访问、暂停或终止服务的权利。

这项规定也与 Anthropic 长期开展的“AI 模型福利”研究有关。该公司一直在研究 AI 是否可能具有意识、主观体验,以及人类应该如何对待 AI 系统。

Anthropic 首席执行官 Dario Amodei 此前表示,目前尚无法确定 AI 是否具有意识。

除了针对 AI 模型的辱骂行为,Anthropic 还调整了政治活动、武器研发和监控等领域的使用规则。

在政治和商业活动中,新政策禁止利用 Claude 运营虚假账号网络、创建虚假新闻网站、隐瞒信息来源,以及开发用于欺骗性舆论操纵的工具。相关限制此前分散在选举、欺诈、隐私和虚假信息等条款中,此次被整合为独立章节。

选举方面,Anthropic 继续禁止利用 Claude 散布有关候选人或投票方式的虚假信息、冒充候选人或选举官员,以及通过欺骗手段阻止选民投票。不过,Anthropic 取消了此前针对个性化选民引导和竞选定向宣传的全面禁令。

Anthropic 解释称,原有规定也限制了一些合法用途,例如非营利组织为选民制作多语言信息,或者选举官员向选民发送选票补正通知。此次调整允许这些活动继续开展,但利用虚假信息操纵选民、滥用选民个人数据等行为仍然被禁止。

在武器研发方面,新政策明确禁止利用 Claude 开发武器控制软件及相关组件,包括武器瞄准、火控和交战系统,以及为无人机和其他自主载具加装武器。

Anthropic 表示,此前曾发现有人试图利用 Claude 编写武器操作指南和控制软件,因此需要进一步明确相关限制。这部分主要是对原有禁令的细化,并非新设禁令。

监控和执法领域的限制也更加具体。新政策禁止未经当事人同意追踪个人,无论是实时监控,还是分析此前收集的数据。

Claude 也不能用于决定或建议执法机关调查、逮捕或起诉哪些人,更不能用于开发或改进服务于被禁止监控活动的工具。

不过,政策仍允许经过当事人同意的追踪活动,例如反欺诈监测。内容审核、新闻报道、合法授权的安全研究和法律研究等用途也不受禁止,但不能用于政策明确禁止的目的。

Anthropic 还在使用政策中为部分政府客户保留了特殊安排。可以根据政府客户的公共职责和法定权限,通过专门合同调整部分使用限制,但前提是 Anthropic 认为相关合同及安全保障措施足以控制风险。

此次更新还增加了 AI 控制机器人等物理设备时的安全要求。

如果 Claude 的输出不经过人工事先审核,就能直接控制可能造成人身伤害的机器人、无人机或工业设备,必须安排具备相应资格的人员监督设备运行,并确保操作人员能够随时停止设备。一旦操作人员介入,或设备与 Anthropic 服务的连接中断,设备必须能够停止运行或保持安全状态。

此外,设备的速度、力度、温度、电压等安全限制,不能完全依赖模型自行判断,而必须由独立于模型输出的硬件或控制系统负责执行。

但这些要求并不适用于所有设备。

例如,操作指令经过合格人员审核后才执行,或者家用设备始终在制造商设定的安全范围内运行,即使发生故障,最严重的后果也只是造成不适或不便,就不受上述高风险物理操作要求约束。

医疗、金融、法律、就业、信贷、保险、住房和教育等领域的规定也进一步明确。对于符合政策定义、可能影响个人权益的高风险建议和重大决策,原则上必须由具备相应资格和权限的人员审核后,才能向当事人提供建议或执行决定,同时需要告知当事人 AI 参与了相关过程。这些要求此前已经存在,此次主要是明确具体适用范围。

一般性信息介绍、内部研究,以及不涉及最终个人建议或重大决策的辅助工作,不受上述人工审核要求限制。在法律允许的情况下,完全有利于当事人的部分决定也可以免除事前人工审核,例如支付保险理赔、批准医生已开具医疗服务的保险覆盖申请,以及批准个人获得医疗服务或公共福利的资格。不过,披露 AI 参与情况等其他义务仍可能适用。

此外,Anthropic 进一步明确了地区访问限制。

根据最新政策,中国大陆、香港和澳门仍不在 Claude 的支持地区名单内。

个人用户只要身处不受支持地区,就不能使用 Claude。

企业方面,即使员工身处美国、新加坡等支持地区,只要所属企业在受限地区注册或设立总部,仍不能以该企业的名义使用 Claude。

限制还延伸至企业的海外子公司。

如果一家企业由不受支持地区的个人或实体直接、间接持有多数股权,或者受到其控制,即使在美国、新加坡等支持地区注册和运营,也不能使用 Claude。

例如,受限国家企业在新加坡设立的全资子公司,同样属于限制范围。这些规定不仅适用于 Claude.ai、Claude Code 和 API 服务,也涵盖通过第三方云平台及授权经销商提供的 Claude 模型。

Anthropic 表示,本轮更新的大部分内容是对现有政策的整理和细化,并非全面扩大禁止范围。其中,武器研发和监控领域主要是明确原有规则;针对 AI 模型的持续无端虐待,以及机器人等自主硬件的安全控制要求,则是此次新增的重点内容。

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

打开网易新闻 查看精彩图片