Eu senti falta do Claude Fable 5 mais do que esperava.
Isso soa estranho para dizer sobre um modelo que teve uma janela de lançamento bagunçada, foi retirado e se tornou envolto em controles de exportação e argumentos de segurança cibernética em questão de dias. Mas o Fable 5 era o modelo Claude que eu queria para trabalho de agente difícil: inspeção de repositórios, longas loops de codificação, uso de ferramentas, depuração e o tipo de tarefas onde o modelo precisa continuar sem transformar o fluxo de trabalho em ruído.
A Anthropic agora diz que o Fable 5 está voltando globalmente. A versão curta: o governo dos EUA aplicou controles de exportação ao Claude Fable 5 e ao Claude Mythos 5 em 12 de junho de 2026. A Anthropic suspendeu o acesso porque não conseguiu verificar a nacionalidade em tempo real. Em 30 de junho, a Anthropic disse que esses controles de exportação haviam sido suspensos, e o Fable 5 começaria a retornar globalmente na quarta-feira, 1 de julho de 2026.
Estou feliz que este capítulo está quase no fim. Quero testar o modelo em trabalho normal novamente, não ler mais uma semana de especulações sobre se ele voltará algum dia.
Por que o Claude Fable 5 é importante
O Fable 5 não é apenas uma pequena atualização de modelo. A Anthropic o descreve como um modelo da classe Mythos feito mais seguro para uso geral. Isso significa que a capacidade subjacente está próxima do Mythos 5 mais restrito, mas o Fable 5 é enviado com salvaguardas e classificadores mais fortes.
Os benchmarks de lançamento explicam por que as pessoas se importaram tanto quando o acesso desapareceu.

| Benchmark | Claude Mythos 5 / Fable 5 | Claude Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
| --- | ---: | ---: | ---: | ---: |
| SWE-bench Pro | 80.3% | 69.2% | 58.6% | 54.2% |
| FrontierCode Diamond | 29.3% | 13.4% | 5.7% | - |
| OSWorld-Verified | 85.0% | 83.4% | 78.7% | 76.2% |
| Terminal-Bench 2.1 | 88.0%* | 82.7% | 83.4% | 70.7% |
| ExploitBench | 78.0%* | 40.0% | 34.0% | - |
| HealthBench Professional | 66.0%* | 56.9% | 51.8% | - |
Os asteriscos são importantes. A Anthropic diz que alguns benchmarks estrelados mostram uma lacuna maior entre o Mythos 5 e o Fable 5 porque as salvaguardas e o comportamento de fallback afetam o Fable. Portanto, eu não leria a tabela como pura capacidade bruta do modelo para cada solicitação do usuário. Eu a leria como a razão pela qual o Fable 5 se tornou tão interessante: ele está próximo do nível Mythos, enquanto ainda é o modelo que a Anthropic quer que usuários e desenvolvedores normais acessem.
Para o meu próprio trabalho, os sinais mais fortes são SWE-bench Pro, Terminal-Bench 2.1 e OSWorld-Verified. Esses se mapeiam mais perto de codificação agente e fluxos de trabalho de uso de computador do que benchmarks de chat genéricos. O Fable 5 parece ser construído para tarefas longas e bagunçadas, onde o modelo precisa inspecionar o estado, usar ferramentas, se recuperar de erros e manter contexto suficiente para terminar.
O novo acordo de salvaguardas
O retorno não é um simples interruptor de volta.
A Anthropic diz que treinou um classificador de segurança melhorado após um relatório da Amazon mostrar uma maneira de contornar as salvaguardas do Fable 5 em torno de solicitações relacionadas a vulnerabilidades. A Anthropic argumenta que o relatório não revelou uma capacidade cibernética única de nível Mythos, mas a empresa ainda se moveu para bloquear o comportamento descrito.
O novo classificador bloqueia a técnica específica daquele relatório em mais de 99% dos casos, de acordo com a Anthropic. Quando uma solicitação é bloqueada, o usuário deve ser notificado e a solicitação pode voltar para o Claude Opus 4.8.

Esse fallback é importante. Isso significa que algum trabalho rotineiro de codificação e depuração pode não atingir o Fable 5 a princípio. Se o classificador vê uma solicitação como muito próxima da cibersegurança, mesmo quando a intenção do usuário é inofensiva, a tarefa pode ir para o Opus 4.8 em vez disso.
Eu espero que isso seja irritante para os desenvolvedores a curto prazo. Depurar sistemas reais frequentemente toca em autenticação, redes, injeção, dependências, logs e linguagem de vulnerabilidade. Um classificador cauteloso pode facilmente confundir engenharia defensiva com uso indevido. A Anthropic diz que irá refinar os classificadores nas próximas semanas para reduzir falsos positivos.
Essa é a troca certa se a alternativa for perder o acesso ao Fable 5 novamente. Ainda assim, a questão prática não é se o classificador está filosoficamente correto. A questão é se ele permite que o trabalho normal de software continue sem forçar cada tarefa adjacente à segurança para um modelo diferente.
A gravidade do jailbreak precisa de uma linguagem compartilhada
O movimento de política mais interessante é o framework que a Anthropic está elaborando com a Amazon, Microsoft, Google e outros parceiros do Glasswing. O objetivo é uma maneira compartilhada de julgar quão severo é um jailbreak de IA e como os provedores de modelos devem responder.

Os critérios propostos pela Anthropic são sensatos:
Isso importa porque nem todo jailbreak tem o mesmo risco. Um prompt que apenas recupera comportamentos de baixo risco dentro da margem de segurança do classificador não é o mesmo que um jailbreak universal que desbloqueia uma ampla classe de capacidades prejudiciais. Tratar ambos como o mesmo tipo de emergência cria incentivos ruins. Os laboratórios ou reagem exageradamente a pequenas descobertas ou subexplicam as grandes.
Uma escala de severidade compartilhada não resolveria a segurança de modelos de fronteira por si só. Pelo menos tornaria a conversa menos caótica.
Minha opinião
Eu quero o Fable 5 de volta porque quero um modelo que pareça valer a pena reservar para o passe difícil.
O Sonnet 5 é agora o motorista diário sensato. Eu escrevi sobre isso no meu artigo de benchmark do Claude Sonnet 5→. É mais barato, prático e forte o suficiente para muitos loops de agente. O Opus 4.8 ainda parece útil como um fallback confiável e modelo de revisão.
O Fable 5 ocupa um slot diferente. Eu o usaria quando a tarefa for cara de qualquer maneira: uma migração arriscada, um bug preso, uma revisão profunda de repositório, um longo fluxo de trabalho agente ou uma peça de análise onde o modelo precisa manter muitas partes móveis ao mesmo tempo.
Eu também gosto que a Anthropic não está fingindo que o redeploy é sem atrito. A empresa está dizendo que os novos classificadores criarão alguns falsos positivos. Isso é melhor do que vender o retorno como se nada tivesse acontecido.
O teste agora é simples: o Fable 5 pode voltar sem se tornar muito nervoso para uso em trabalho de engenharia real?
Se a resposta for sim, estou feliz que isso acabou. Eu senti falta do modelo e quero colocá-lo de volta nos fluxos de trabalho onde o Sonnet é bom, mas não é suficiente.
