AI范儿 · 今日速评⏱ 3 分钟
Anthropic 的官方已经宣布,之前被禁的Fable 5 会在明天(7月1号凌晨)恢复上线。
但这次,不是仅仅恢复服务那么简单了,它还带来了一套新的规则。
01不是全平台同步恢复
首先呢,它不是全平台同步恢复。
Anthropic 说 Fable 从 7月1号重新开放,覆盖Claude Platform、Claude.ai、Claude Code和Cloud CoWork。
也就是官网开发者平台、代码工具和企业协作产品会先恢复。
但是第三方的平台像AWS、Google Cloud、Microsoft Foundry这些云平台,并没有同步恢复,而是说"会尽快恢复"。
这个很明显的变化是,以前模型发布都是全平台同时上线的,但这一次明显是分批放行。
这可能意味着,这种顶尖模型的上线已经不像以前那样,只是 AI 公司内部开个开关那么简单。其背后还涉及到了云厂商、企业客户、合规审查以及和政府的沟通。
可能这种方式以后会变成一种常态。
以后可能就听不到什么全球同步上线了,而是会根据不同平台、不同用户、不同渠道来分批开放。
02会员权益也不能随便用了
第二个变化就更加明显了。
简单来说,即便是会员也不能够随便用Fable 5,它不是简单地回到了所有会员套餐中。
对于 Pro、Max、Team 以及部分 Enterprise 用户,在 7 月 7 号之前,它会被纳入每周的使用额度,但最多只能占每周额度的50%。7 月 7 号之后,它会改成通过 Usage Credits(用量积分)来使用。
企业版的限制则更加明显。
标准的 Enterprise 席位没有包含 Fable 5 的默认额度,所有使用都要通过 Usage Credits 计费。如果没有开启 Credits,就无法使用。
也就说,Fable 5 不再是普通会员的权益,而更像是一种单独计费、单独配额、单独管理的高级资源。
这样的模式其实也不是第一次看到,在 Claude Design 里面就有类似的模式。还有大家知道在 OpenClaw 里,也需要单独购买 Usage Credits才能使用 Claude。
所以现在就很明显,这种顶级模型也正在变成一种稀缺资源。
03新增的安全处理方式
这次还有一个变化,就是 Fable 5 新增了一套安全处理的方式。
他们训练了一个新的安全分类器,专门针对之前被发现过的越狱模式。
如果用户向 Fable 5 提出的请求被拦截了,系统会通知用户,同时会把这个请求转交到 Opus 4.8 来处理。
这跟我们很多人想象的可能不太一样,对吧?之前我们提到一个敏感的问题,AI 会直接拒绝回答。
那现在换了一个方式了,一旦你问了一个敏感的问题,高级模型不回答,而是切换到一个风险更低的模型来回答你。
这其实也是一种模型降级的机制。
这个方式说实话之前我们还没有在别的厂里面看到,说不定这个方式也会变成未来所有模型的标配。
但坦白讲,这种方式带来的体验可能会很糟糕。它会带一些副作用,可能会频繁地误伤正常的请求。
04政府更早进入发布流程
最后一个变化就是政府会更早地进入模型发布的流程。
Anthropic 表示,对于那些跟国家安全相关的模型,他们会给指定的政府伙伴提供更早访问模型和安全机制的机会。
这些政府伙伴可以在大模型发布之前,独立进行一些模型的能力测试,也可以测试 Anthropic 的安全护栏。
也就是说,以前的模式是:模型公司训练模型 -> 自己测试 -> 自己发布 -> 用户使用。
未来的模式则会变成:模型公司训练模型 -> 内部测试 -> 开放给政府提前测试 -> 安全机构评估 -> 公司修复护栏 -> 分渠道、分地区、分权限发布。
所以,这已经不像是一个普通的软件更新了,而更像是一种战略技术的释放过程。
我们可以理解这种监管,但从用户的角度看,AI 模型发布的自由度确实正在下降。
对于商业模型,我觉得大概率慢慢大家都会往这个方向走。唯一的不确定性在于,那些开源模型会不会也跟进这样的路线?
05十八天,一分钟看懂
如果你之前没有关注这件事,可以用一分钟快速了解整个过程。
6 月 9 日:Anthropic 正式发布 Fable 5 和 Mythos 5,两者共享同一底层模型,但 Fable 5 加了更强的安全护栏用于面向大众开放,Mythos 5 仅提供给 Project Glasswing 的小范围可信合作伙伴用于防御性网络安全场景。
(在此之后):Amazon 安全团队向 Anthropic 提交了一份漏洞报告,指出他们找到一种绕过 Fable 5 安全护栏的方法,通过特定提示词,诱导模型帮忙定位软件漏洞。
6 月 12 日:美国政府在获悉这份报告后,对 Fable 5 和 Mythos 5 实施出口管制,要求限制外籍用户(无论身处美国境内还是境外)访问这两款模型。
随后:由于管制令即时生效,Anthropic 没有可靠的方式实时核实用户国籍,于是干脆暂停了所有用户对这两款模型的访问。
6 月中下旬:Anthropic 与政府方面及 Amazon 密切配合,针对报告中披露的具体绕过手法,重新训练了一版更强的安全分类器,并调整了模型的安全策略。
6 月 26 日:Mythos 5 率先恢复,对一批经审批的美国机构开放。
6 月 30 日:Anthropic 发布《Redeploying Fable 5》公告,宣布安全加固完成,并公布新的分批发布和使用规则。
7 月 1 日:Fable 5 正式对 Claude Platform、Claude.ai、Claude Code 和 Claude Cowork 上的全球用户恢复开放;AWS、Google Cloud、Microsoft Foundry 等第三方平台将"尽快"跟进恢复。
你觉得这种"分批开放、分级计费"会是以后所有顶尖模型的标配吗?
觉得有用 → 点个❤️在看转给朋友
热门跟贴