AI伦理治理出现新动向。为应对人机交互中的极端不当行为,Anthropic近日更新使用政策,自11月12日起禁止用户无故虐待AI模型,违规者将面临限流乃至封号等处罚。
据媒体当地时间10月8日报道,Anthropic当天更新使用政策,明确禁止用户对其AI模型实施“持续且无谓的辱骂或残忍行为”。新政策将于11月12日正式生效。这是Anthropic一年多来首次修订使用政策。
公司指出,新规只适用于极端情形,即用户在没有明显目的的情况下,反复对模型实施残忍行为。用户日常表达不满、反驳模型观点、创作黑暗题材内容,以及开展模型测试与研究,均不在禁止之列。
打开网易新闻 查看精彩图片
热门跟贴