Claude Fable 5 Återvänder: Prestanda och Min Åsikt
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Claude Fable 5 Återvänder: Prestanda och Min Åsikt

Claude Fable 5 återvänder globalt efter att exportkontrollerna har lyfts. Här är prestandasiffrorna, nya skyddsåtgärder och varför jag saknade denna modell.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Uppdaterad 26 juli 2026
6 min read

Jag saknade Claude Fable 5 mer än jag förväntade mig.

Det låter konstigt att säga om en modell som hade ett rörigt lanseringsfönster, drogs tillbaka och blev insvept i exportkontroller och cybersäkerhetsargument inom dagar. Men Fable 5 var den Claude-modell jag ville ha för hårt agentarbete: repo-inspektion, långa kodloopar, verktygsanvändning, felsökning och den typ av uppgifter där modellen måste fortsätta utan att förvandla arbetsflödet till brus.

Anthropic säger nu att Fable 5 återvänder globalt. Den korta versionen: den amerikanska regeringen tillämpade exportkontroller på Claude Fable 5 och Claude Mythos 5 den 12 juni 2026. Anthropic suspenderade åtkomsten eftersom de inte kunde verifiera nationalitet i realtid. Den 30 juni sade Anthropic att dessa exportkontroller hade lyfts, och Fable 5 skulle börja återvända globalt onsdagen den 1 juli 2026.

Jag är glad att detta kapitel nästan är över. Jag vill testa modellen i normalt arbete igen, inte läsa en vecka av spekulationer om huruvida den någonsin kommer tillbaka.

Varför Claude Fable 5 är viktigt

Fable 5 är inte en annan liten modelluppdatering. Anthropic beskriver den som en Mythos-klassmodell som gjorts säkrare för allmän användning. Det betyder att den underliggande kapaciteten är nära den mer begränsade Mythos 5, men Fable 5 levereras med starkare skydd och klassificerare.

Lanseringsprestanda förklarar varför folk brydde sig så mycket när åtkomsten försvann.

Claude Fable 5 och Mythos 5 prestandatabell från Anthropic
Claude Fable 5 och Mythos 5 prestandatabell från Anthropic
PrestandaClaude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

Asteriskarna är viktiga. Anthropic säger att vissa stjärnmärkta prestanda visar en större skillnad mellan Mythos 5 och Fable 5 eftersom skyddsåtgärder och fallback-beteende påverkar Fable. Så jag skulle inte läsa tabellen som ren rå modellkapacitet för varje användarförfrågan. Jag skulle läsa den som anledningen till att Fable 5 blev så intressant: den är nära Mythos-nivån samtidigt som den fortfarande är modellen som Anthropic vill att vanliga användare och utvecklare ska få tillgång till.

För mitt eget arbete är de starkaste signalerna SWE-bench Pro, Terminal-Bench 2.1 och OSWorld-Verified. Dessa kartlägger närmare till agentisk kodning och datoranvändningsarbetsflöden än generiska chattprestanda. Fable 5 verkar vara byggd för långa, röriga uppgifter där modellen måste inspektera tillstånd, använda verktyg, återhämta sig från fel och hålla tillräckligt med kontext för att avsluta.

Den nya skyddsåtgärden

Återkomsten är inte en enkel strömbrytare tillbaka på.

Anthropic säger att de har tränat en förbättrad säkerhetsklassificerare efter att en Amazon-rapport visade ett sätt att kringgå Fable 5:s skyddsåtgärder kring sårbarhetsrelaterade förfrågningar. Anthropic hävdar att rapporten inte avslöjade unik Mythos-nivå cybersäkerhetskapacitet, men företaget flyttade ändå för att blockera det beskrivna beteendet.

Den nya klassificeraren blockerar den specifika tekniken från den rapporten i mer än 99% av fallen, enligt Anthropic. När en förfrågan blockeras bör användaren meddelas och förfrågan kan falla tillbaka till Claude Opus 4.8.

Anthropic-diagram som visar normala skyddsåtgärder kontra Fable 5:s skyddsåtgärder
Anthropic-diagram som visar normala skyddsåtgärder kontra Fable 5:s skyddsåtgärder

Den fallbacken är viktig. Det betyder att vissa rutinmässiga kodnings- och felsökningsarbeten kanske inte träffar Fable 5 i början. Om klassificeraren ser en förfrågan som för nära cybersäkerhet, även när användarens avsikt är ofarlig, kan uppgiften gå till Opus 4.8 istället.

Jag förväntar mig att det kommer att vara irriterande för utvecklare på kort sikt. Felsökning av verkliga system berör ofta autentisering, nätverk, injektion, beroenden, loggar och sårbarhetsspråk. En försiktig klassificerare kan lätt missta defensiv ingenjörskonst för missbruk. Anthropic säger att de kommer att förfina klassificerarna under de kommande veckorna för att minska falska positiva.

Det är den rätta avvägningen om alternativet är att förlora åtkomsten till Fable 5 igen. Ändå är den praktiska frågan inte huruvida klassificeraren är filosofiskt korrekt. Frågan är om den låter normalt mjukvaruarbete fortsätta utan att tvinga varje säkerhetsnära uppgift till en annan modell.

Jailbreak-svårighetsgrad behöver ett gemensamt språk

Den mer intressanta politiska åtgärden är ramverket som Anthropic utarbetar tillsammans med Amazon, Microsoft, Google och andra Glasswing-partners. Målet är ett gemensamt sätt att bedöma hur allvarlig en AI-jailbreak är och hur modellleverantörer bör svara.

Anthropic-diagram som visar mindre, snäva skadliga och universella jailbreak-kategorier
Anthropic-diagram som visar mindre, snäva skadliga och universella jailbreak-kategorier

Anthropics föreslagna kriterier är rimliga:

kapacitetsökning
bredd av kapacitetsökning
lätthet att beväpna
upptäckbarhet

Detta är viktigt eftersom inte varje jailbreak har samma risk. En prompt som bara återhämtar låg-riskbeteende inom klassificerarens säkerhetsmarginal är inte densamma som en universell jailbreak som låser upp en bred klass av skadliga kapabiliteter. Att behandla båda som samma typ av nödsituation skapar dåliga incitament. Laboratorier överreagerar antingen på små fynd eller förklarar inte de stora.

En gemensam svårighetsgrad skulle inte lösa gränsmodellens säkerhet av sig själv. Det skulle åtminstone göra samtalet mindre kaotiskt.

Min åsikt

Jag vill ha tillbaka Fable 5 eftersom jag vill ha en modell som känns värd att reservera för den svåra passagen.

Rekommenderat läsning

Sonnet 5 är nu den rimliga dagliga drivaren. Jag skrev om det i min Claude Sonnet 5 prestandaartikel. Den är billigare, praktisk och tillräckligt stark för många agentloopar. Opus 4.8 ser fortfarande användbar ut som en pålitlig fallback och granskningsmodell.

Fable 5 sitter i en annan slot. Jag skulle använda den när uppgiften är dyr oavsett: en riskabel migrering, en fast bug, en djup repo-granskning, ett långt agentiskt arbetsflöde eller en analys där modellen måste hålla många rörliga delar på en gång.

Jag gillar också att Anthropic inte låtsas att återutplaceringen är friktionsfri. Företaget säger att de nya klassificerarna kommer att skapa några falska positiva. Det är bättre än att sälja återkomsten som om ingenting hade hänt.

Testet nu är enkelt: kan Fable 5 komma tillbaka utan att bli för nervös för att använda för verkligt ingenjörsarbete?

Om svaret är ja, är jag glad att detta är över. Jag saknade modellen, och jag vill sätta tillbaka den i arbetsflödena där Sonnet är bra men inte tillräckligt.

Källor kontrollerade den 1 juli 2026