Claude Fable 5 回归:基准测试和我的看法
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Claude Fable 5 回归:基准测试和我的看法

Claude Fable 5 在出口管制解除后全球回归。以下是基准数据、新的安全措施,以及我为何错过这个模型。

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
更新於 2026年7月26日
6 min read

我比预期更想念 Claude Fable 5。

这听起来很奇怪,关于一个在发布窗口混乱、被撤回,并在几天内被出口管制和网络安全争论包围的模型。但 Fable 5 是我想要用于硬代理工作的 Claude 模型:仓库检查、长编码循环、工具使用、调试,以及模型必须持续进行而不将工作流程变成噪音的任务。

Anthropic 现在表示 Fable 5 正在全球回归。简而言之:美国政府于 2026 年 6 月 12 日对 Claude Fable 5 和 Claude Mythos 5 实施了出口管制。由于无法实时验证国籍,Anthropic 暂停了访问。6 月 30 日,Anthropic 表示这些出口管制已被解除,Fable 5 将于 2026 年 7 月 1 日星期三开始全球回归。

我很高兴这一章快要结束了。我想再次在正常工作中测试这个模型,而不是再读一周关于它是否会回来的一切猜测。

为什么 Claude Fable 5 重要

Fable 5 不是另一个小模型的更新。Anthropic 将其描述为为一般使用而更安全的 Mythos 级模型。这意味着其基础能力接近更受限制的 Mythos 5,但 Fable 5 配备了更强的安全措施和分类器。

发布基准解释了为什么人们在访问消失时如此关心。

Claude Fable 5 和 Mythos 5 基准表来自 Anthropic
Claude Fable 5 和 Mythos 5 基准表来自 Anthropic
基准Claude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

星号很重要。Anthropic 表示,一些带星号的基准显示 Mythos 5 和 Fable 5 之间的差距更大,因为安全措施和后备行为影响了 Fable。因此,我不会将表格视为每个用户请求的纯原始模型能力。我会将其视为 Fable 5 变得如此有趣的原因:它接近 Mythos 级别,同时仍然是 Anthropic 希望普通用户和开发者可以访问的模型。

对于我自己的工作,最强的信号是 SWE-bench Pro、Terminal-Bench 2.1 和 OSWorld-Verified。这些更接近代理编码和计算机使用工作流程,而不是通用聊天基准。Fable 5 看起来是为长时间、复杂的任务而构建的,在这些任务中,模型必须检查状态、使用工具、从错误中恢复,并保持足够的上下文以完成。

新的安全措施

回归并不是简单的开关。

Anthropic 表示,在亚马逊报告显示了一种绕过 Fable 5 针对与漏洞相关请求的安全措施的方法后,它训练了一个改进的安全分类器。Anthropic 认为该报告并未揭示独特的 Mythos 级网络能力,但公司仍然采取措施阻止所描述的行为。

根据 Anthropic 的说法,新的分类器在 99% 以上的情况下阻止了该报告中的特定技术。当请求被阻止时,用户应收到通知,并且请求可以回退到 Claude Opus 4.8。

Anthropic 图示显示正常安全措施与 Fable 5 安全措施
Anthropic 图示显示正常安全措施与 Fable 5 安全措施

这种回退很重要。这意味着某些常规编码和调试工作可能在最初不会触及 Fable 5。如果分类器将请求视为过于接近网络安全,即使用户的意图是无害的,任务可能会转到 Opus 4.8。

我预计这在短期内会让开发者感到烦恼。调试真实系统通常涉及身份验证、网络、注入、依赖关系、日志和漏洞语言。一个谨慎的分类器很容易将防御性工程误认为是误用。Anthropic 表示,它将在接下来的几周内完善分类器,以减少误报。

如果失去对 Fable 5 的访问是替代方案,那么这是正确的权衡。不过,实际问题并不是分类器在哲学上是否正确。问题是它是否允许正常的软件工作继续,而不强迫每个与安全相关的任务转到不同的模型。

越狱严重性需要共享语言

更有趣的政策举措是 Anthropic 正在与亚马逊、微软、谷歌和其他 Glasswing 合作伙伴起草的框架。目标是共享一种判断 AI 越狱严重性以及模型提供者应如何响应的方式。

Anthropic 图示显示轻微、有害和普遍越狱类别
Anthropic 图示显示轻微、有害和普遍越狱类别

Anthropic 提出的标准是合理的:

能力增益
能力增益的广度
武器化的容易程度
可发现性

这很重要,因为并非每个越狱都有相同的风险。一个仅在分类器安全边际内恢复低风险行为的提示,与一个解锁广泛有害能力的普遍越狱并不相同。将两者视为同一种紧急情况会产生不良激励。实验室要么对小发现反应过度,要么对大发现解释不足。

一个共享的严重性等级不会单独解决前沿模型的安全性。但至少会使对话不那么混乱。

我的看法

我想要 Fable 5 回归,因为我想要一个值得保留用于艰难任务的模型。

推薦閱讀

Sonnet 5 现在是合理的日常驱动程序。我在我的 Claude Sonnet 5 基准文章 中写过这个。它更便宜、实用,并且足够强大以应对许多代理循环。Opus 4.8 仍然看起来是一个可靠的后备和审查模型。

Fable 5 则处于不同的位置。当任务无论如何都很昂贵时,我会使用它:一次风险迁移、一个卡住的错误、一次深入的仓库审查、一条长的代理工作流程,或者一项分析,其中模型必须同时保持许多动态部分。

我也喜欢 Anthropic 并没有假装重新部署是无摩擦的。公司表示新的分类器会产生一些误报。这比将回归销售得好像什么都没有发生要好。

现在的测试很简单:Fable 5 能否在不变得过于敏感以用于真实工程工作的情况下回归?

如果答案是肯定的,我很高兴这一切结束了。我想念这个模型,并希望将其重新投入到 Sonnet 足够但不够的工作流程中。

2026 年 7 月 1 日检查的来源