Claude Fable 5 Retorna: Benchmarks e Minha Opinião
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Claude Fable 5 Retorna: Benchmarks e Minha Opinião

Claude Fable 5 está voltando globalmente após a suspensão dos controles de exportação. Aqui estão os números de benchmark, novas salvaguardas e por que eu senti falta deste modelo.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Atualizado 26 de jul. de 2026
6 min read

Eu senti falta do Claude Fable 5 mais do que esperava.

Isso soa estranho para dizer sobre um modelo que teve uma janela de lançamento bagunçada, foi retirado e se tornou envolto em controles de exportação e argumentos de segurança cibernética em questão de dias. Mas o Fable 5 era o modelo Claude que eu queria para trabalho de agente difícil: inspeção de repositórios, longas loops de codificação, uso de ferramentas, depuração e o tipo de tarefas onde o modelo precisa continuar sem transformar o fluxo de trabalho em ruído.

A Anthropic agora diz que o Fable 5 está voltando globalmente. A versão curta: o governo dos EUA aplicou controles de exportação ao Claude Fable 5 e ao Claude Mythos 5 em 12 de junho de 2026. A Anthropic suspendeu o acesso porque não conseguiu verificar a nacionalidade em tempo real. Em 30 de junho, a Anthropic disse que esses controles de exportação haviam sido suspensos, e o Fable 5 começaria a retornar globalmente na quarta-feira, 1 de julho de 2026.

Estou feliz que este capítulo está quase no fim. Quero testar o modelo em trabalho normal novamente, não ler mais uma semana de especulações sobre se ele voltará algum dia.

Por que o Claude Fable 5 é importante

O Fable 5 não é apenas uma pequena atualização de modelo. A Anthropic o descreve como um modelo da classe Mythos feito mais seguro para uso geral. Isso significa que a capacidade subjacente está próxima do Mythos 5 mais restrito, mas o Fable 5 é enviado com salvaguardas e classificadores mais fortes.

Os benchmarks de lançamento explicam por que as pessoas se importaram tanto quando o acesso desapareceu.

Tabela de benchmark do Claude Fable 5 e Mythos 5 da Anthropic
Tabela de benchmark do Claude Fable 5 e Mythos 5 da Anthropic
BenchmarkClaude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

Os asteriscos são importantes. A Anthropic diz que alguns benchmarks estrelados mostram uma lacuna maior entre o Mythos 5 e o Fable 5 porque as salvaguardas e o comportamento de fallback afetam o Fable. Portanto, eu não leria a tabela como pura capacidade bruta do modelo para cada solicitação do usuário. Eu a leria como a razão pela qual o Fable 5 se tornou tão interessante: ele está próximo do nível Mythos, enquanto ainda é o modelo que a Anthropic quer que usuários e desenvolvedores normais acessem.

Para o meu próprio trabalho, os sinais mais fortes são SWE-bench Pro, Terminal-Bench 2.1 e OSWorld-Verified. Esses se mapeiam mais perto de codificação agente e fluxos de trabalho de uso de computador do que benchmarks de chat genéricos. O Fable 5 parece ser construído para tarefas longas e bagunçadas, onde o modelo precisa inspecionar o estado, usar ferramentas, se recuperar de erros e manter contexto suficiente para terminar.

O novo acordo de salvaguardas

O retorno não é um simples interruptor de volta.

A Anthropic diz que treinou um classificador de segurança melhorado após um relatório da Amazon mostrar uma maneira de contornar as salvaguardas do Fable 5 em torno de solicitações relacionadas a vulnerabilidades. A Anthropic argumenta que o relatório não revelou uma capacidade cibernética única de nível Mythos, mas a empresa ainda se moveu para bloquear o comportamento descrito.

O novo classificador bloqueia a técnica específica daquele relatório em mais de 99% dos casos, de acordo com a Anthropic. Quando uma solicitação é bloqueada, o usuário deve ser notificado e a solicitação pode voltar para o Claude Opus 4.8.

Diagrama da Anthropic mostrando salvaguardas normais versus salvaguardas do Fable 5
Diagrama da Anthropic mostrando salvaguardas normais versus salvaguardas do Fable 5

Esse fallback é importante. Isso significa que algum trabalho rotineiro de codificação e depuração pode não atingir o Fable 5 a princípio. Se o classificador vê uma solicitação como muito próxima da cibersegurança, mesmo quando a intenção do usuário é inofensiva, a tarefa pode ir para o Opus 4.8 em vez disso.

Eu espero que isso seja irritante para os desenvolvedores a curto prazo. Depurar sistemas reais frequentemente toca em autenticação, redes, injeção, dependências, logs e linguagem de vulnerabilidade. Um classificador cauteloso pode facilmente confundir engenharia defensiva com uso indevido. A Anthropic diz que irá refinar os classificadores nas próximas semanas para reduzir falsos positivos.

Essa é a troca certa se a alternativa for perder o acesso ao Fable 5 novamente. Ainda assim, a questão prática não é se o classificador está filosoficamente correto. A questão é se ele permite que o trabalho normal de software continue sem forçar cada tarefa adjacente à segurança para um modelo diferente.

A gravidade do jailbreak precisa de uma linguagem compartilhada

O movimento de política mais interessante é o framework que a Anthropic está elaborando com a Amazon, Microsoft, Google e outros parceiros do Glasswing. O objetivo é uma maneira compartilhada de julgar quão severo é um jailbreak de IA e como os provedores de modelos devem responder.

Diagrama da Anthropic mostrando categorias de jailbreaks menores, prejudiciais e universais
Diagrama da Anthropic mostrando categorias de jailbreaks menores, prejudiciais e universais

Os critérios propostos pela Anthropic são sensatos:

ganho de capacidade
amplitude do ganho de capacidade
facilidade de armamento
descobribilidade

Isso importa porque nem todo jailbreak tem o mesmo risco. Um prompt que apenas recupera comportamentos de baixo risco dentro da margem de segurança do classificador não é o mesmo que um jailbreak universal que desbloqueia uma ampla classe de capacidades prejudiciais. Tratar ambos como o mesmo tipo de emergência cria incentivos ruins. Os laboratórios ou reagem exageradamente a pequenas descobertas ou subexplicam as grandes.

Uma escala de severidade compartilhada não resolveria a segurança de modelos de fronteira por si só. Pelo menos tornaria a conversa menos caótica.

Minha opinião

Eu quero o Fable 5 de volta porque quero um modelo que pareça valer a pena reservar para o passe difícil.

Recomendado para você

O Sonnet 5 é agora o motorista diário sensato. Eu escrevi sobre isso no meu artigo de benchmark do Claude Sonnet 5. É mais barato, prático e forte o suficiente para muitos loops de agente. O Opus 4.8 ainda parece útil como um fallback confiável e modelo de revisão.

O Fable 5 ocupa um slot diferente. Eu o usaria quando a tarefa for cara de qualquer maneira: uma migração arriscada, um bug preso, uma revisão profunda de repositório, um longo fluxo de trabalho agente ou uma peça de análise onde o modelo precisa manter muitas partes móveis ao mesmo tempo.

Eu também gosto que a Anthropic não está fingindo que o redeploy é sem atrito. A empresa está dizendo que os novos classificadores criarão alguns falsos positivos. Isso é melhor do que vender o retorno como se nada tivesse acontecido.

O teste agora é simples: o Fable 5 pode voltar sem se tornar muito nervoso para uso em trabalho de engenharia real?

Se a resposta for sim, estou feliz que isso acabou. Eu senti falta do modelo e quero colocá-lo de volta nos fluxos de trabalho onde o Sonnet é bom, mas não é suficiente.

Fontes verificadas em 1 de julho de 2026