J'ai manqué Claude Fable 5 plus que je ne l'avais prévu.
Cela peut sembler étrange à dire à propos d'un modèle qui a eu une fenêtre de lancement chaotique, a été retiré et s'est retrouvé enveloppé dans des contrôles à l'exportation et des arguments de cybersécurité en quelques jours. Mais Fable 5 était le modèle Claude que je voulais pour un travail d'agent difficile : inspection de dépôt, longues boucles de codage, utilisation d'outils, débogage et le genre de tâches où le modèle doit continuer sans transformer le flux de travail en bruit.
Anthropic dit maintenant que Fable 5 revient à l'échelle mondiale. En résumé : le gouvernement américain a appliqué des contrôles à l'exportation sur Claude Fable 5 et Claude Mythos 5 le 12 juin 2026. Anthropic a suspendu l'accès car il ne pouvait pas vérifier la nationalité en temps réel. Le 30 juin, Anthropic a déclaré que ces contrôles à l'exportation avaient été levés et que Fable 5 commencerait à revenir à l'échelle mondiale le mercredi 1er juillet 2026.
Je suis heureux que ce chapitre soit presque terminé. Je veux tester le modèle dans un travail normal à nouveau, pas lire une autre semaine de spéculations sur la question de savoir s'il reviendra un jour.
Pourquoi Claude Fable 5 est important
Fable 5 n'est pas un simple rafraîchissement de petit modèle. Anthropic le décrit comme un modèle de classe Mythos rendu plus sûr pour un usage général. Cela signifie que la capacité sous-jacente est proche du Mythos 5 plus restreint, mais Fable 5 est livré avec des mesures de sécurité et des classificateurs plus robustes.
Les benchmarks de lancement expliquent pourquoi les gens se souciaient tant lorsque l'accès a disparu.

| Benchmark | Claude Mythos 5 / Fable 5 | Claude Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| --- | ---: | ---: | ---: | ---: |
| SWE-bench Pro | 80.3% | 69.2% | 58.6% | 54.2% |
| FrontierCode Diamond | 29.3% | 13.4% | 5.7% | - |
| OSWorld-Verified | 85.0% | 83.4% | 78.7% | 76.2% |
| Terminal-Bench 2.1 | 88.0%* | 82.7% | 83.4% | 70.7% |
| ExploitBench | 78.0%* | 40.0% | 34.0% | - |
| HealthBench Professional | 66.0%* | 56.9% | 51.8% | - |
Les astérisques comptent. Anthropic dit que certains benchmarks étoilés montrent un écart plus important entre Mythos 5 et Fable 5 parce que les mesures de sécurité et le comportement de secours affectent Fable. Donc, je ne lirais pas le tableau comme une pure capacité brute du modèle pour chaque demande utilisateur. Je le lirais comme la raison pour laquelle Fable 5 est devenu si intéressant : il est proche de la catégorie Mythos tout en étant le modèle qu'Anthropic veut que les utilisateurs normaux et les développeurs aient accès.
Pour mon propre travail, les signaux les plus forts sont SWE-bench Pro, Terminal-Bench 2.1 et OSWorld-Verified. Ceux-ci correspondent plus à des flux de travail de codage agentique et d'utilisation d'ordinateur qu'à des benchmarks de chat génériques. Fable 5 semble construit pour des tâches longues et désordonnées où le modèle doit inspecter l'état, utiliser des outils, récupérer des erreurs et garder suffisamment de contexte pour terminer.
Le nouvel accord de sécurité
Le retour n'est pas un simple interrupteur à remettre en marche.
Anthropic dit qu'il a formé un classificateur de sécurité amélioré après qu'un rapport d'Amazon a montré un moyen de contourner les mesures de sécurité de Fable 5 autour des demandes liées aux vulnérabilités. Anthropic soutient que le rapport n'a pas révélé de capacité cybernétique unique de niveau Mythos, mais l'entreprise a tout de même agi pour bloquer le comportement décrit.
Le nouveau classificateur bloque la technique spécifique de ce rapport dans plus de 99 % des cas, selon Anthropic. Lorsqu'une demande est bloquée, l'utilisateur doit être informé et la demande peut revenir à Claude Opus 4.8.

Ce retour est important. Cela signifie que certains travaux de codage et de débogage de routine peuvent ne pas toucher Fable 5 au début. Si le classificateur considère une demande comme trop proche de la cybersécurité, même lorsque l'intention de l'utilisateur est inoffensive, la tâche peut aller à Opus 4.8 à la place.
Je m'attends à ce que cela soit ennuyeux pour les développeurs à court terme. Le débogage de systèmes réels touche souvent à l'authentification, au réseau, à l'injection, aux dépendances, aux journaux et au langage des vulnérabilités. Un classificateur prudent peut facilement confondre l'ingénierie défensive avec un usage abusif. Anthropic dit qu'il affinera les classificateurs au cours des prochaines semaines pour réduire les faux positifs.
C'est le bon compromis si l'alternative est de perdre l'accès à Fable 5 à nouveau. Cependant, la question pratique n'est pas de savoir si le classificateur est philosophiquement correct. La question est de savoir s'il permet à un travail logiciel normal de continuer sans forcer chaque tâche adjacente à la sécurité sur un modèle différent.
La gravité du jailbreak nécessite un langage partagé
Le mouvement politique le plus intéressant est le cadre qu'Anthropic est en train de rédiger avec Amazon, Microsoft, Google et d'autres partenaires de Glasswing. L'objectif est de trouver un moyen partagé d'évaluer la gravité d'un jailbreak d'IA et comment les fournisseurs de modèles devraient répondre.

Les critères proposés par Anthropic sont sensés :
Cela a de l'importance car tous les jailbreaks n'ont pas le même risque. Un prompt qui ne récupère que des comportements à faible risque à l'intérieur de la marge de sécurité du classificateur n'est pas le même qu'un jailbreak universel qui déverrouille une large classe de capacités nuisibles. Traiter les deux comme le même type d'urgence crée de mauvaises incitations. Les laboratoires réagissent soit de manière excessive à de petites découvertes, soit sous-expliquent les grandes.
Une échelle de gravité partagée ne résoudrait pas à elle seule la sécurité des modèles de pointe. Elle rendrait au moins la conversation moins chaotique.
Mon avis
Je veux Fable 5 de retour parce que je veux un modèle qui semble valoir la peine d'être réservé pour le passage difficile.
Sonnet 5 est maintenant le conducteur quotidien sensé. J'en ai parlé dans mon article de benchmark sur Claude Sonnet 5→. Il est moins cher, pratique et suffisamment puissant pour de nombreuses boucles d'agents. Opus 4.8 semble toujours utile en tant que modèle de secours et de révision fiable.
Fable 5 se situe dans une autre catégorie. Je l'utiliserais lorsque la tâche est coûteuse dans tous les cas : une migration risquée, un bug bloqué, une révision de dépôt approfondie, un long flux de travail agentique ou une analyse où le modèle doit gérer de nombreuses pièces mobiles à la fois.
J'aime aussi qu'Anthropic ne prétende pas que le redéploiement est sans friction. L'entreprise dit que les nouveaux classificateurs créeront certains faux positifs. C'est mieux que de vendre le retour comme si rien ne s'était passé.
Le test maintenant est simple : Fable 5 peut-il revenir sans devenir trop nerveux pour être utilisé pour un véritable travail d'ingénierie ?
Si la réponse est oui, je suis heureux que ce soit terminé. Le modèle m'a manqué, et je veux le remettre dans les flux de travail où Sonnet est bon mais pas suffisant.
