来源:市场资讯
(来源:石臻说AI)
石臻说AI
编辑:石臻
导读: Fable 5 回来了,但这次回归之后,很多人第一感觉不是“神模归来”,而是:怎么没有 6 月那版猛了?我更愿意把这个争议拆开看:模型本体未必被砍,但挡在它前面的安全闸门明显变严了。对做代码审查、调试、重构和安全相关工作的用户来说,体验上就会像是“模型被削弱了”。
分数掉得很难看,但先别急着说权重被砍
这波讨论的起点,是 BridgeMind 在 7 月 2 日贴的一组 BridgeBench 复测结果。他们把 7 月 1 日重新开放后的 Claude Fable 5 拿去跑,同一套测试里,几个分数掉得很夸张:
BridgeBench 项目6 月版本7 月 1 日版本Debugging86.225.9Refactoring73.638.4Hallucination75.961.7
单看这张表,很容易得出一个粗暴结论:Fable 5 被砍了。
但 BridgeMind 后面自己也补了一句更关键的话:当任务真的能跑到 Fable 5 时,它表现得像 6 月 12 日那版;问题是太多任务在进入模型之前就被安全层拦下,或者被切到 Opus 4.8。BridgeBench 的做法是,如果任务触发 fallback,就按 0 分算。BridgeMind 还举了调试集的例子:12 个任务里只有 3 个真正跑过去。
这就让“削弱”这个词变得微妙了。
被削的可能不是 Fable 5 的脑子,而是你能不能碰到它。
BridgeBench 另一条调试榜单截图:同一模型名下,7 月 1 日版本从 86.2 掉到 25.9
官方其实早把副作用写出来了
Anthropic 在 6 月 9 日发布 Fable 5 和 Mythos 5。两者共享同一个底层模型,区别在于 Fable 5 是给普通用户用的版本,外面包了一层更强的 safeguard;Mythos 5 则只给受信任的 Glasswing 伙伴,部分防护会放开。
6 月 12 日,美国政府对 Fable 5 和 Mythos 5 施加出口管制,Anthropic 因为没法实时验证用户国籍,干脆把两款模型都暂停了。6 月 30 日,官方说出口管制已经解除,Fable 5 从 7 月 1 日开始重新对全球用户开放。
重新开放时,官方同时加了一层新的安全分类器。
这层分类器的作用,是在请求或输出看起来涉及高风险网络安全、生物化学、模型蒸馏等方向时,阻止 Fable 5 继续响应,并把请求交给 Opus 4.8。API 侧也能看到 stop_reason: "refusal",而不是普通报错。
官方在 redeploying 说明里把代价讲得很直白:新分类器会更频繁地误伤良性的日常 coding 和 debugging 请求。
Anthropic 官方解释的 classifier safety margin:Fable 5 的安全余量明显更宽,代价是更多良性请求被挡住
这张图其实就是整件事的答案。
普通 safeguard 的边界更靠右,很多“可能有点安全味但基本良性”的请求还能过。Fable 5 的边界往左收得更多,安全余量变大了,危险请求更难漏过去,但良性请求也更容易被挡在门外。
所以现在的 Fable 5 更像一辆很猛的车,但出高速口前多了一道特别敏感的闸机。你如果跑的是写作、普通问答、轻量代码,可能没感觉;你如果做的是大型调试、仓库审查、安全加固、权限治理、CI/CD 审计,闸机就可能反复亮红灯。
评论区为什么会吵成两拨人
这次评论区最有意思的地方,是两边都不一定在撒谎。
有人说没感觉到差异。比如 BridgeMind 原帖下面,有用户直接说“我这边不觉得有什么不同”。BridgeMind 的回复是:能完成时确实一样,问题是 guardrails 挡得太多。
也有人给出了很典型的 false positive 例子。DigitalAssetBuzz 写了一段长帖,说自己在 Claude Code 里用 Fable 5 做私有仓库的只读防御性审查,没有要求修改代码、没有漏洞利用、没有渗透测试、没有攻击链,结果最后报告做完后,系统提示 safeguard 触发,会话被切到 Opus 4.8。
DigitalAssetBuzz 描述一次防御性仓库审查触发 safeguard 的经历
这类例子解释了为什么体验会分裂。
如果你的工作从头到尾都没有踩到分类器边界,你看到的还是 Fable 5。它可能依旧有那种长任务推进、少量提示就自己补全上下文的能力。
但如果你的任务里出现“security audit”“vulnerability”“policy enforcement”“defensive hardening”“agent verifier”这些词,哪怕你做的是防御性工作,也可能被判断成需要更保守处理。对用户来说,屏幕上出现的是 fallback,账单和额度也会被真实消耗,最后的体感当然是:我付的是 Fable 5,拿到的却像 Opus 4.8。
这也是我觉得最准确的说法:不是所有人都拿到了削弱版模型,而是有些人更频繁地拿不到 Fable 5。
为什么大家对这次回归这么敏感
Fable 5 之所以能引发这么大落差,是因为 6 月发布时,Anthropic 给它的叙事非常强。
官方说它是 Anthropic 目前最强的广泛可用模型,在软件工程、知识工作、视觉、科研等任务上都有领先表现。发布页里还给了很多很抓人的例子:Stripe 用它在一天内做完 5000 万行 Ruby 代码库迁移;Fable 5 可以从截图重建网页源码;还有一个官方 YouTube time-lapse,展示它只靠原始游戏截图通关 Pokémon FireRed。
Anthropic 首发页里的官方 benchmark 表:Fable 5 / Mythos 5 在多项长任务和 agentic coding 评测中领先
这种“像高级工程师一样自己推进任务”的能力,正是用户怀念 6 月版本的原因。它不是普通聊天模型的小升级,而是那种让开发者觉得“我可以把更大的项目扔给它”的模型。
所以 7 月回归后,如果同样的人把仓库审查、调试、重构、自动化代理这些重活再扔过去,却频繁看到 safeguard 或 Opus fallback,失望会被放大。
这里还有一个现实成本:Fable 5 / Mythos 5 的价格是每百万输入 token 10 美元、输出 token 50 美元;API 和企业场景还要求 30 天数据留存,不支持 Zero Data Retention。订阅用户这次重新开放也不是完全放开:Pro、Max、Team 和部分 Enterprise 计划到 7 月 7 日前最多占每周使用额度的 50%,之后转 usage credits。
换句话说,它现在不只是“更难摸到原始能力”,还是“更贵、更受限、更需要你确认场景适不适合”的模型。
Anthropic 官方另一张 jailbreak / classifier 图:安全层越强,越依赖边界判断是否准确
我现在更稳妥的判断是:
Fable 5 回归后,未必是底层模型被降智了。更像是 Anthropic 把“能不能让你用到 Fable 5”的边界收窄了。
对普通用户,这可能只是偶尔奇怪的拒答。对安全、代码审计、复杂调试、长链路 agent 工作流用户,这就是实打实的产品降级。因为这些场景恰好最容易踩到分类器,也最需要 Fable 5 原本被夸得最狠的那部分能力。
所以如果你现在要用它,我会这么分:
- 普通创作、研究、非敏感代码任务:可以试,很多人可能感受不到明显变差。
- 复杂调试、重构、大仓库审查:先用自己的 eval 跑一遍,不要只看官方首发 benchmark。
- 安全、治理、审计、红队/蓝队边界任务:要特别留意 fallback、拒答类别、额度消耗和最终输出质量。
- 企业或隐私敏感工作流:先确认 30 天留存和 ZDR 限制能不能接受。
这次最值得看的,不是“Fable 5 到底是不是被砍了”这种二选一问题。
更值得看的,是从 Fable 5 开始,前沿模型正在变成一套路由系统:模型能力是一层,安全分类器是一层,fallback 是一层,计费和访问权限又是一层。
以后用户抱怨“模型变弱”,可能并不是模型真的不会了,而是你已经不一定能稳定接触到那个会的模型。
热门跟贴