我比预期更想念 Claude Fable 5。
这听起来很奇怪,关于一个在发布窗口混乱、被撤回,并在几天内被出口管制和网络安全争论包围的模型。但 Fable 5 是我想要用于硬代理工作的 Claude 模型:仓库检查、长编码循环、工具使用、调试,以及模型必须持续进行而不将工作流程变成噪音的任务。
Anthropic 现在表示 Fable 5 正在全球回归。简而言之:美国政府于 2026 年 6 月 12 日对 Claude Fable 5 和 Claude Mythos 5 实施了出口管制。由于无法实时验证国籍,Anthropic 暂停了访问。6 月 30 日,Anthropic 表示这些出口管制已被解除,Fable 5 将于 2026 年 7 月 1 日星期三开始全球回归。
我很高兴这一章快要结束了。我想再次在正常工作中测试这个模型,而不是再读一周关于它是否会回来的一切猜测。
为什么 Claude Fable 5 重要
Fable 5 不是另一个小模型的更新。Anthropic 将其描述为为一般使用而更安全的 Mythos 级模型。这意味着其基础能力接近更受限制的 Mythos 5,但 Fable 5 配备了更强的安全措施和分类器。
发布基准解释了为什么人们在访问消失时如此关心。

| 基准 | Claude Mythos 5 / Fable 5 | Claude Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| --- | ---: | ---: | ---: | ---: |
| SWE-bench Pro | 80.3% | 69.2% | 58.6% | 54.2% |
| FrontierCode Diamond | 29.3% | 13.4% | 5.7% | - |
| OSWorld-Verified | 85.0% | 83.4% | 78.7% | 76.2% |
| Terminal-Bench 2.1 | 88.0%* | 82.7% | 83.4% | 70.7% |
| ExploitBench | 78.0%* | 40.0% | 34.0% | - |
| HealthBench Professional | 66.0%* | 56.9% | 51.8% | - |
星号很重要。Anthropic 表示,一些带星号的基准显示 Mythos 5 和 Fable 5 之间的差距更大,因为安全措施和后备行为影响了 Fable。因此,我不会将表格视为每个用户请求的纯原始模型能力。我会将其视为 Fable 5 变得如此有趣的原因:它接近 Mythos 级别,同时仍然是 Anthropic 希望普通用户和开发者可以访问的模型。
对于我自己的工作,最强的信号是 SWE-bench Pro、Terminal-Bench 2.1 和 OSWorld-Verified。这些更接近代理编码和计算机使用工作流程,而不是通用聊天基准。Fable 5 看起来是为长时间、复杂的任务而构建的,在这些任务中,模型必须检查状态、使用工具、从错误中恢复,并保持足够的上下文以完成。
新的安全措施
回归并不是简单的开关。
Anthropic 表示,在亚马逊报告显示了一种绕过 Fable 5 针对与漏洞相关请求的安全措施的方法后,它训练了一个改进的安全分类器。Anthropic 认为该报告并未揭示独特的 Mythos 级网络能力,但公司仍然采取措施阻止所描述的行为。
根据 Anthropic 的说法,新的分类器在 99% 以上的情况下阻止了该报告中的特定技术。当请求被阻止时,用户应收到通知,并且请求可以回退到 Claude Opus 4.8。

这种回退很重要。这意味着某些常规编码和调试工作可能在最初不会触及 Fable 5。如果分类器将请求视为过于接近网络安全,即使用户的意图是无害的,任务可能会转到 Opus 4.8。
我预计这在短期内会让开发者感到烦恼。调试真实系统通常涉及身份验证、网络、注入、依赖关系、日志和漏洞语言。一个谨慎的分类器很容易将防御性工程误认为是误用。Anthropic 表示,它将在接下来的几周内完善分类器,以减少误报。
如果失去对 Fable 5 的访问是替代方案,那么这是正确的权衡。不过,实际问题并不是分类器在哲学上是否正确。问题是它是否允许正常的软件工作继续,而不强迫每个与安全相关的任务转到不同的模型。
越狱严重性需要共享语言
更有趣的政策举措是 Anthropic 正在与亚马逊、微软、谷歌和其他 Glasswing 合作伙伴起草的框架。目标是共享一种判断 AI 越狱严重性以及模型提供者应如何响应的方式。

Anthropic 提出的标准是合理的:
这很重要,因为并非每个越狱都有相同的风险。一个仅在分类器安全边际内恢复低风险行为的提示,与一个解锁广泛有害能力的普遍越狱并不相同。将两者视为同一种紧急情况会产生不良激励。实验室要么对小发现反应过度,要么对大发现解释不足。
一个共享的严重性等级不会单独解决前沿模型的安全性。但至少会使对话不那么混乱。
我的看法
我想要 Fable 5 回归,因为我想要一个值得保留用于艰难任务的模型。
Sonnet 5 现在是合理的日常驱动程序。我在我的 Claude Sonnet 5 基准文章→ 中写过这个。它更便宜、实用,并且足够强大以应对许多代理循环。Opus 4.8 仍然看起来是一个可靠的后备和审查模型。
Fable 5 则处于不同的位置。当任务无论如何都很昂贵时,我会使用它:一次风险迁移、一个卡住的错误、一次深入的仓库审查、一条长的代理工作流程,或者一项分析,其中模型必须同时保持许多动态部分。
我也喜欢 Anthropic 并没有假装重新部署是无摩擦的。公司表示新的分类器会产生一些误报。这比将回归销售得好像什么都没有发生要好。
现在的测试很简单:Fable 5 能否在不变得过于敏感以用于真实工程工作的情况下回归?
如果答案是肯定的,我很高兴这一切结束了。我想念这个模型,并希望将其重新投入到 Sonnet 足够但不够的工作流程中。
