Claude Fable 5 Geri Dönüyor: Karşılaştırmalar ve Benim Görüşüm
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Claude Fable 5 Geri Dönüyor: Karşılaştırmalar ve Benim Görüşüm

Claude Fable 5, ihracat kontrollerinin kaldırılmasının ardından dünya genelinde geri dönüyor. İşte karşılaştırma rakamları, yeni güvenlik önlemleri ve bu modeli neden özlediğim.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Güncellendi 26 Tem 2026
6 min read

Claude Fable 5'i beklediğimden daha fazla özledim.

Bu, karmaşık bir lansman sürecine sahip, geri çekilen ve birkaç gün içinde ihracat kontrolleri ve siber güvenlik tartışmalarıyla sarılmış bir model hakkında söylenmesi garip bir şey. Ama Fable 5, zor ajan çalışmaları için istediğim Claude modeliydi: repo incelemesi, uzun kodlama döngüleri, araç kullanımı, hata ayıklama ve modelin iş akışını gürültüye dönüştürmeden devam etmesi gereken türden görevler.

Anthropic şimdi Fable 5'in dünya genelinde geri döneceğini söylüyor. Kısa versiyon: ABD hükümeti, 12 Haziran 2026'da Claude Fable 5 ve Claude Mythos 5'e ihracat kontrolleri uyguladı. Anthropic, milliyeti gerçek zamanlı olarak doğrulayamadığı için erişimi askıya aldı. 30 Haziran'da Anthropic, bu ihracat kontrollerinin kaldırıldığını ve Fable 5'in 1 Temmuz 2026 Çarşamba günü dünya genelinde geri dönmeye başlayacağını söyledi.

Bu bölümün neredeyse sona ermesinden memnunum. Modeli normal işlerde tekrar test etmek istiyorum, bir daha ne zaman geri döneceği hakkında spekülasyon okumak istemiyorum.

Neden Claude Fable 5 Önemli

Fable 5, başka bir küçük model yenilemesi değil. Anthropic, bunu genel kullanım için daha güvenli hale getirilmiş bir Mythos sınıfı model olarak tanımlıyor. Bu, temel yeteneğin daha kısıtlı Mythos 5'e yakın olduğu anlamına geliyor, ancak Fable 5 daha güçlü güvenlik önlemleri ve sınıflandırıcılarla birlikte geliyor.

Lansman karşılaştırmaları, erişim kaybolduğunda insanların neden bu kadar önem verdiğini açıklıyor.

Claude Fable 5 ve Mythos 5 karşılaştırma tablosu
Claude Fable 5 ve Mythos 5 karşılaştırma tablosu
KarşılaştırmaClaude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

Yıldızlar önemlidir. Anthropic, bazı yıldızlı karşılaştırmaların Mythos 5 ile Fable 5 arasında daha büyük bir fark gösterdiğini çünkü güvenlik önlemleri ve geri dönüş davranışlarının Fable'ı etkilediğini söylüyor. Bu nedenle, tabloyu her kullanıcı isteği için saf ham model yeteneği olarak okumazdım. Bunu Fable 5'in bu kadar ilginç hale gelmesinin nedeni olarak okurdum: Mythos seviyesine yakınken, Anthropic'in normal kullanıcıların ve geliştiricilerin erişmesini istediği model.

Kendi çalışmalarım için en güçlü sinyaller SWE-bench Pro, Terminal-Bench 2.1 ve OSWorld-Verified. Bunlar, genel sohbet karşılaştırmalarından daha çok ajans kodlama ve bilgisayar kullanımı iş akışlarına daha yakın. Fable 5, modelin durumu incelemesi, araç kullanması, hatalardan kurtulması ve bitirmek için yeterli bağlamı tutması gereken uzun, karmaşık görevler için inşa edilmiş gibi görünüyor.

Yeni güvenlik anlaşması

Dönüş, basit bir açma kapama değil.

Anthropic, bir Amazon raporu Fable 5'in zafiyetle ilgili talepler etrafındaki güvenlik önlemlerini aşmanın bir yolunu gösterdikten sonra geliştirilmiş bir güvenlik sınıflandırıcısı eğittiğini söylüyor. Anthropic, raporun benzersiz Mythos seviyesinde siber yetenekleri ortaya çıkarmadığını savunuyor, ancak şirket yine de tanımlanan davranışı engellemek için harekete geçti.

Yeni sınıflandırıcı, o rapordaki belirli tekniği %99'dan fazla durumda engelliyor, diyor Anthropic. Bir talep engellendiğinde, kullanıcı bilgilendirilmelidir ve talep Claude Opus 4.8'e geri dönebilir.

Anthropic diyagramı, normal güvenlik önlemleri ile Fable 5 güvenlik önlemleri arasındaki farkı gösteriyor
Anthropic diyagramı, normal güvenlik önlemleri ile Fable 5 güvenlik önlemleri arasındaki farkı gösteriyor

Bu geri dönüş önemlidir. Bu, bazı rutin kodlama ve hata ayıklama çalışmalarının başlangıçta Fable 5'e ulaşamayabileceği anlamına geliyor. Sınıflandırıcı, bir talebi siber güvenlik ile çok yakın gördüğünde, kullanıcı niyeti zararsız olsa bile, görev Opus 4.8'e gidebilir.

Kısa vadede geliştiriciler için bunun sinir bozucu olmasını bekliyorum. Gerçek sistemleri hata ayıklamak genellikle kimlik doğrulama, ağ, enjeksiyon, bağımlılıklar, günlükler ve zafiyet dili ile ilgilidir. Dikkatli bir sınıflandırıcı, savunma mühendisliğini yanlış kullanımla kolayca karıştırabilir. Anthropic, yanlış pozitifleri azaltmak için önümüzdeki haftalarda sınıflandırıcıları geliştireceğini söylüyor.

Bu, Fable 5'e tekrar erişimi kaybetmektense doğru bir takas. Yine de pratik soru, sınıflandırıcının felsefi olarak doğru olup olmadığı değil. Soru, normal yazılım çalışmalarının devam etmesine izin verip vermediği ve her güvenlikle ilgili görevi farklı bir modele zorlamadan devam edip edemeyeceğidir.

Jailbreak şiddeti için ortak bir dil gerekiyor

Daha ilginç politika hamlesi, Anthropic'in Amazon, Microsoft, Google ve diğer Glasswing ortaklarıyla tasarladığı çerçeve. Amaç, bir AI jailbreak'inin ne kadar ciddi olduğunu ve model sağlayıcılarının nasıl yanıt vermesi gerektiğini ortak bir şekilde değerlendirmektir.

Anthropic diyagramı, küçük, dar zararlı ve evrensel jailbreak kategorilerini gösteriyor
Anthropic diyagramı, küçük, dar zararlı ve evrensel jailbreak kategorilerini gösteriyor

Anthropic'in önerdiği kriterler mantıklı:

yetenek kazanımı
yetenek kazanımının genişliği
silahlandırma kolaylığı
keşfedilebilirlik

Bu önemlidir çünkü her jailbreak aynı riske sahip değildir. Sınıflandırıcı güvenlik marjı içinde yalnızca düşük riskli davranışları geri kazanan bir istem, geniş bir zararlı yetenek sınıfını açan evrensel bir jailbreak ile aynı değildir. Her ikisini de aynı türden bir acil durum olarak ele almak kötü teşvikler yaratır. Laboratuvarlar ya küçük bulgulara aşırı tepki verir ya da büyük olanları yeterince açıklamaz.

Ortak bir şiddet ölçeği, sınır modeli güvenliğini kendi başına çözmez. En azından konuşmayı daha az kaotik hale getirir.

Benim Görüşüm

Fable 5'in geri dönmesini istiyorum çünkü zor geçiş için ayırmaya değer bir model istiyorum.

Sonnet 5 artık mantıklı bir günlük sürücü. Bunu Claude Sonnet 5 karşılaştırma makalemde yazdım. Daha ucuz, pratik ve birçok ajans döngüsü için yeterince güçlü. Opus 4.8 hala güvenilir bir geri dönüş ve inceleme modeli olarak faydalı görünüyor.

Fable 5 farklı bir konumda yer alıyor. Görev her halükarda pahalı olduğunda kullanırım: riskli bir geçiş, takılı bir hata, derin bir repo incelemesi, uzun bir ajans iş akışı veya modelin birden fazla hareketli parçayı aynı anda tutması gereken bir analiz parçası.

Ayrıca Anthropic'in yeniden dağıtımın sorunsuz olduğunu iddia etmediğini beğeniyorum. Şirket, yeni sınıflandırıcıların bazı yanlış pozitifler yaratacağını söylüyor. Bu, dönüşü hiçbir şey olmamış gibi satmaktan daha iyidir.

Şimdi test basit: Fable 5, gerçek mühendislik çalışmaları için kullanılacak kadar atak olmadan geri dönebilir mi?

Cevap evet ise, bunun sona ermesinden mutluyum. Modeli özledim ve Sonnet'in iyi ama yeterli olmadığı iş akışlarına geri koymak istiyorum.

1 Temmuz 2026'da kontrol edilen kaynaklar