Claude Fable 5の復活:ベンチマークと私の見解
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Claude Fable 5の復活:ベンチマークと私の見解

Claude Fable 5は輸出規制が解除された後、世界的に復活します。ここではベンチマークの数値、新しい安全対策、そして私がこのモデルを見逃した理由について説明します。

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
更新日 2026年7月26日
6 min read

私は予想以上にClaude Fable 5を見逃しました。

それは、混乱したローンチウィンドウを持ち、すぐに引き戻され、数日以内に輸出規制やサイバーセーフティの議論に巻き込まれたモデルについて言うのは奇妙に聞こえるかもしれません。しかし、Fable 5は私がハードエージェント作業のために望んでいたClaudeモデルでした:リポジトリの検査、長いコーディングループ、ツールの使用、デバッグ、そしてモデルがワークフローをノイズに変えずに進み続けなければならないようなタスクです。

Anthropicは現在、Fable 5が世界的に復活すると言っています。短いバージョン:米国政府は2026年6月12日にClaude Fable 5とClaude Mythos 5に輸出規制を適用しました。Anthropicは国籍をリアルタイムで確認できなかったため、アクセスを一時停止しました。6月30日、Anthropicはその輸出規制が解除されたと述べ、Fable 5は2026年7月1日水曜日から世界的に復活を開始すると発表しました。

この章がほぼ終わることを嬉しく思います。私は再び通常の作業でモデルをテストしたいです。Fable 5が本当に戻ってくるのかどうかについての推測をもう一週間読むのは嫌です。

なぜClaude Fable 5が重要なのか

Fable 5は単なる小さなモデルのリフレッシュではありません。Anthropicはこれを一般的な使用のために安全性を高めたMythosクラスのモデルとして説明しています。つまり、基盤となる能力はより制限されたMythos 5に近いですが、Fable 5はより強力な安全対策と分類器を備えて出荷されます。

ローンチベンチマークは、アクセスが消えたときに人々がなぜそれほど関心を持ったのかを説明しています。

Claude Fable 5とMythos 5のベンチマークテーブル(Anthropic提供)
Claude Fable 5とMythos 5のベンチマークテーブル(Anthropic提供)
ベンチマークClaude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

アスタリスクは重要です。Anthropicは、一部の星付きベンチマークがMythos 5とFable 5の間に大きなギャップを示す理由は、安全対策とフォールバック動作がFableに影響を与えるからだと述べています。したがって、私はこのテーブルをすべてのユーザーリクエストに対する純粋な生のモデル能力として読むべきではありません。私はこれを、Fable 5がなぜそれほど興味深くなったのかの理由として読むべきです:それはMythos層に近いですが、Anthropicが通常のユーザーや開発者にアクセスしてほしいモデルであるからです。

私自身の作業にとって、最も強い信号はSWE-bench Pro、Terminal-Bench 2.1、OSWorld-Verifiedです。これらは一般的なチャットベンチマークよりもエージェントコーディングやコンピュータ使用ワークフローに近いです。Fable 5は、モデルが状態を検査し、ツールを使用し、エラーから回復し、完了するために十分なコンテキストを保持しなければならない長くて混乱したタスクのために構築されているように見えます。

新しい安全対策の取り決め

復帰は単純なスイッチの切り替えではありません。

Anthropicは、Amazonの報告書がFable 5の脆弱性関連リクエストに関する安全対策を回避する方法を示した後、改善された安全分類器を訓練したと述べています。Anthropicは、報告書が独自のMythosレベルのサイバー能力を明らかにしたわけではないと主張していますが、同社は依然として記載された動作をブロックするために動きました。

新しい分類器は、Anthropicによると、その報告書の特定の技術を99%以上のケースでブロックします。リクエストがブロックされると、ユーザーに通知され、リクエストはClaude Opus 4.8にフォールバックすることができます。

Anthropicの図:通常の安全対策とFable 5の安全対策の比較
Anthropicの図:通常の安全対策とFable 5の安全対策の比較

そのフォールバックは重要です。これは、いくつかのルーチンコーディングやデバッグ作業が最初にFable 5に当たらない可能性があることを意味します。分類器がリクエストをサイバーセキュリティに非常に近いと見なす場合、ユーザーの意図が無害であっても、タスクは代わりにOpus 4.8に送られる可能性があります。

私は、これが短期的には開発者にとって煩わしいものであると予想しています。実際のシステムのデバッグは、認証、ネットワーキング、インジェクション、依存関係、ログ、脆弱性言語に触れることがよくあります。慎重な分類器は、防御的エンジニアリングを誤って誤用と見なすことが容易です。Anthropicは、今後数週間で分類器を洗練させて偽陽性を減らすと述べています。

それは、再びFable 5へのアクセスを失うことが代替手段である場合、正しいトレードオフです。それでも、実際の問題は、分類器が哲学的に正しいかどうかではありません。問題は、通常のソフトウェア作業が続けられるかどうかであり、すべてのセキュリティに関連するタスクを異なるモデルに強制することなく続けられるかどうかです。

ジェイルブレイクの深刻度には共通の言語が必要

より興味深い政策の動きは、AnthropicがAmazon、Microsoft、Google、その他のGlasswingパートナーと共に策定しているフレームワークです。目標は、AIのジェイルブレイクがどれほど深刻であるかを判断する共通の方法と、モデルプロバイダーがどのように対応すべきかです。

Anthropicの図:軽微、狭い有害、普遍的なジェイルブレイクのカテゴリ
Anthropicの図:軽微、狭い有害、普遍的なジェイルブレイクのカテゴリ

Anthropicが提案する基準は合理的です:

能力の向上
能力の向上の幅
武器化の容易さ
発見可能性

これは重要です。なぜなら、すべてのジェイルブレイクが同じリスクを持っているわけではないからです。分類器の安全マージン内で低リスクの行動を回復するだけのプロンプトは、有害な能力の広いクラスを解除する普遍的なジェイルブレイクとは異なります。両者を同じ種類の緊急事態として扱うことは悪いインセンティブを生み出します。ラボは小さな発見に過剰反応するか、大きな発見を十分に説明しないかのどちらかです。

共通の深刻度スケールは、フロンティアモデルの安全性を自体で解決するわけではありませんが、少なくとも会話を混乱させることは少なくなります。

私の見解

私はFable 5を戻したいです。なぜなら、ハードパスのために予約する価値があるモデルが欲しいからです。

おすすめ

Sonnet 5は現在、理にかなった日常のドライバーです。私はそれについて私のClaude Sonnet 5ベンチマーク記事で書きました。これは安価で実用的で、多くのエージェントループに十分な強さを持っています。Opus 4.8は、信頼できるフォールバックおよびレビュー用モデルとして依然として有用に見えます。

Fable 5は異なるスロットに位置しています。私は、タスクがどちらにしても高価な場合に使用します:リスクのある移行、スタックしたバグ、深いリポジトリレビュー、長いエージェントワークフロー、またはモデルが同時に多くの動く部分を保持しなければならない分析の一部です。

また、Anthropicが再展開が摩擦のないものであるかのように振る舞っていないことが好きです。同社は、新しい分類器がいくつかの偽陽性を生み出すだろうと言っています。それは、何も起こらなかったかのように復帰を売り込むよりも良いです。

今のテストはシンプルです:Fable 5は実際のエンジニアリング作業に使用するにはあまりにも神経質にならずに戻ってくることができるでしょうか?

もし答えが「はい」なら、私はこれが終わったことを嬉しく思います。私はこのモデルを見逃しており、Sonnetが良いが十分ではないワークフローに戻したいです。

2026年7月1日に確認した情報源