Claude Sonnet 5 Yayında: Kıyaslamalar, Fiyatlandırma ve İlk İzlenimlerim
Tech
Claude Sonnet 5
Anthropic
AI Models
Claude Code

Claude Sonnet 5 Yayında: Kıyaslamalar, Fiyatlandırma ve İlk İzlenimlerim

Claude Sonnet 5 resmi olarak duyuruldu. Kıyaslamalar, daha uygun fiyatlı bir Sonnet modelinin Opus sınıfı ajan işlerine yaklaştığını, ancak önemli sınırlamaları olduğunu gösteriyor.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Güncellendi 4 Tem 2026
7 min read

Claude Sonnet 5, Anthropic'in Fable 5 dramasından sonra piyasaya sürmesini beklediğim model: Mythos kadar dramatik değil, küçük bir yükseltmeden çok daha pratik ve açıkça günlük ajan işlerine odaklanmış.

Anthropic, Claude Sonnet 5'i 30 Haziran 2026'da piyasaya sürdü. Manşet, Sonnet'in aniden her Opus sınıfı modeli geçmesi değil. Bu böyle değil. Önemli olan hikaye maliyet-performans dengesi. Sonnet 5, ajan işlerinde Opus 4.8'e çok daha yaklaşıyor, Sonnet fiyatlandırmasını koruyor ve birçok Claude kullanıcısı için yeni varsayılan model haline geliyor.

Bu, AI ajanlarını kullanma şeklim için önemli. Tek seferlik sohbet cevaplarından çok, bir modelin bir repoyu inceleyip inceleyememesi, araçları kullanıp kullanamaması, görevde kalıp kalamaması ve ortalığı karıştırmadan bir işi bitirip bitirememesiyle ilgileniyorum.

Kıyaslama anlık görüntüsü

Anthropic'in lansman tablosu Sonnet 5'i Sonnet 4.6 ve Opus 4.8 ile karşılaştırıyor. Desen net: Sonnet 5, Sonnet 4.6'ya göre gerçek bir sıçrama, ancak Opus 4.8 bazı en zorlu ajan görevlerinde hala lider.

Anthropic'ten Sonnet 5, Sonnet 4.6 ve Opus 4.8'i karşılaştıran Claude Sonnet 5 kıyaslama tablosu
Anthropic'ten Sonnet 5, Sonnet 4.6 ve Opus 4.8'i karşılaştıran Claude Sonnet 5 kıyaslama tablosu
KıyaslamaSonnet 5Sonnet 4.6Opus 4.8
------:---:---:
SWE-bench Pro63.2%58.1%69.2%
Terminal-Bench 2.180.4%67.0%82.7%
Humanity's Last Exam, araçsız43.2%34.6%49.8%
Humanity's Last Exam, araçlı57.4%46.8%57.9%
OSWorld-Verified81.2%78.5%83.4%
GDPval-AA v2161813951615

En güçlü sinyal Terminal-Bench 2.1. Sonnet 5, Sonnet 4.6'nın %67.0'ından %80.4'e sıçrayarak %82.7 ile Opus 4.8'e yaklaşıyor. Bu, kodlama ajanları için önemli olan türden bir boşluk kapatmadır çünkü terminal çalışması, plan yapamayan, toparlanamayan ve araçları kullanamayan modelleri cezalandırır.

SWE-bench Pro daha muhafazakar. Sonnet 5, Sonnet 4.6'ya göre iyileşme gösteriyor ancak Opus 4.8 hala önde. Bunu bir hype cevabı değil, bir satın alma cevabı olarak okurdum: normal ajan çalıştırmaları için Sonnet 5'i kullanın, ekstra güvenilirliğin fiyata değdiği durumlar için Opus'u saklayın.

Gerçek lansman hikayesi maliyet-performanstır

Anthropic ayrıca çaba seviyeleri boyunca BrowseComp ve OSWorld-Verified için maliyet-performans grafikleri yayınladı. Bunlar tek bir üst düzey puandan daha kullanışlıdır çünkü Sonnet 5 artık ekiplere bir düğme sunuyor: orta düzey çaba için daha az harcayın veya görev gerektiğinde çabayı artırın.

BrowseComp üzerinde Claude Sonnet 5 ajan arama maliyet performans eğrisi
BrowseComp üzerinde Claude Sonnet 5 ajan arama maliyet performans eğrisi
OSWorld-Verified üzerinde Claude Sonnet 5 ajan bilgisayar kullanımı maliyet performans eğrisi
OSWorld-Verified üzerinde Claude Sonnet 5 ajan bilgisayar kullanımı maliyet performans eğrisi

Bir Sonnet sınıfı modelin tam da burada kazanması gerekir. Opus daha zor akıl yürütme için vardır, ancak çoğu iş akışı, ajanı tekrar tekrar çalıştırabileceğiniz bir fiyata yeterli zekaya ihtiyaç duyar. Hata ayıklama, tarayıcı QA, repo incelemesi, içerik operasyonları ve küçük otomasyon görevlerinin tümü, işin ortasında ipin ucunu kaçırmadan daha ucuza çalıştırılabilen bir modelden faydalanır.

Anthropic, Sonnet 5'in 31 Ağustos 2026'ya kadar milyon giriş token'ı başına 2$ ve milyon çıkış token'ı başına 10$'lık tanıtım API fiyatlandırmasıyla mevcut olduğunu belirtiyor. Bundan sonra, milyon token başına 3$ giriş ve 15$ çıkış fiyatına geçiyor. Bu standart fiyat, token başına Sonnet 4.6 ile eşleşiyor, ancak bir catch var: dokümantasyon, Sonnet 5'in aynı metin için yaklaşık %30 daha fazla token üreten yeni bir tokenizer kullandığını söylüyor.

Bu yüzden geçişin otomatik olarak maliyet-nötr olduğunu söyleyemem. Uzun süreli ajanları Sonnet 4.6'dan Sonnet 5'e taşımadan önce prompt'ları yeniden sayardım.

Geliştiriciler için neler değişiyor

Model ID'si `claude-sonnet-5`. Anthropic bunu Sonnet 4.6'dan tak-çalıştır bir yükseltme olarak tanımlıyor, ancak dokümantasyon gerçek uygulamalarda önemli olan davranış değişikliklerini listeliyor.

İlk olarak, uyarlanabilir düşünme (adaptive thinking) varsayılan olarak açık. Bir thinking alanı iletmezseniz, Sonnet 5 yine de uyarlanabilir düşünme ile çalışır. Bunu devre dışı bırakabilirsiniz, ancak varsayılan değişti.

İkincisi, manuel genişletilmiş düşünme kaldırıldı. Eski `thinking: { type: "enabled", budget_tokens: N }` deseni 400 hatası döndürür. Anthropic, geliştiricilerin bunun yerine effort parametresi ile uyarlanabilir düşünmeyi kullanmasını istiyor.

Üçüncüsü, varsayılan olmayan örnekleme parametreleri reddediliyor. `temperature`, `top_p` veya `top_k` değerlerini varsayılan olmayan değerlere ayarlayan istekler 400 hatası döndürür. Eğer wrapper'larınız otomatik olarak örnekleme varsayılanlarını ayarlıyorsa, bu gerçek bir geçiş sorunudur.

İyi kısmı: Sonnet 5 varsayılan olarak 1M token bağlam penceresini ve 128k'ya kadar çıkış token'ını destekliyor. Repo ölçeğindeki çalışmalar ve uzun bağlam iş akışları için bu, ajanlara düzenlemeden önce inceleme konusunda daha fazla alan sağlar.

Güvenlik ve siber kıyaslamalar

Anthropic, Sonnet 5'i sıradan ajan kullanımı için Sonnet 4.6'dan daha güvenli olarak konumlandırıyor. Lansman gönderisi, Sonnet 5'in Sonnet 4.6'ya göre istenmeyen davranış oranının daha düşük olduğunu ve ajan bağlamlarında daha güvenli olduğunu belirtiyor.

Siber grafik daha önemli olan sınırlamadır. Anthropic, Sonnet 5'i bilinçli olarak siber güvenlik görevleri üzerinde eğitmediğini söylüyor. Firefox 147 exploit-geliştirme değerlendirmesinde Sonnet 5 hiçbir zaman tam çalışan bir exploit üretmedi. Çalışan exploit başarısında %0.0 ve kısmi başarıda %13.2 puan aldı. Opus 4.8 ve Mythos 5 bu değerlendirmede çok daha güçlü; bu da Anthropic'in daha yüksek riskli modeller etrafında neden farklı erişim ve güvenlik bariyeri politikaları sürdürdüğünün tam nedenidir.

Anthropic'ten Claude Sonnet 5 Firefox 147 exploit geliştirme değerlendirmesi
Anthropic'ten Claude Sonnet 5 Firefox 147 exploit geliştirme değerlendirmesi

Bu çerçeve mantıklı. Sonnet 5 normal kodlama ve ajan işleri için yeterince güçlü olmalı, ancak tehlikeli siber yetenekler için optimize edilmemelidir. Anthropic ayrıca Sonnet 5'in, varsayılan olarak etkinleştirilmiş gerçek zamanlı siber güvenlik önlemleriyle piyasaya sürüldüğünü belirtiyor.

İlk izlenimim

Claude Sonnet 5'i Claude ajanları için yeni varsayılan iş atı modeli olarak ele alırdım.

Her zor kod tabanı problemi için seçeceğim model değil. Opus 4.8 hala bazı ajan kodlama ve bilgisayar kullanımı kıyaslamalarında kazanıyor. Fable 5 hala daha dramatik sınır hikayesi. Ancak Sonnet 5, çoğu geliştiricinin gerçekten hissettiği pazar bölümüne iniyor: fiyat, bağlam, araç kullanımı ve ajanın devam edip etmemesi.

Claude Code için bu muhtemelen en ilginç açı. Daha uzun çalışabilen, araçları daha iyi kullanabilen ve birçok görevde Opus'a yakın kalabilen daha ucuz bir model, ajan döngülerinin ekonomisini değiştirir. Opus sınıfı modelleri inceleme, zor hata ayıklama veya yüksek riskli değişiklikler için ayırabilir, ana yürütme geçişi için ise Sonnet 5'i kullanabilirsiniz.

Bunu ilk olarak şöyle test ederdim:

kirli bir repo
başarısız bir build
bir tarayıcı QA görevi
uzun bir bağlam geçişi
gerçek bağlantılar ve görseller içeren bir içerik iş akışı
ölçülülük gerektiren küçük bir dağıtım adımı
Sizin için önerilenler

Kıyaslamalarda iyi puan alan bir modelin hala gerçek bir iş akışı içinde davranması gerekir. Mevcut dosyaları okumalı, ilgisiz düzenlemelerden kaçınmalı, kontrolleri çalıştırmalı ve sonraki adım insan kararı gerektirdiğinde durmalıdır. Bu işletim tarzı hakkında Claude Code /loop ve /goal makalemde yazmıştım.

Karar

Claude Sonnet 5, Anthropic'in ajan çağı için maliyet-performans cevabı gibi görünüyor. Her yerde onun yerini aldığını iddia etmeden Opus 4.8 ile olan boşluğu daraltıyor.

Kıyaslamalar, terminal çalışması, araç kullanımı, bilgisayar kullanımı, bilgi işi ve akıl yürütme konularında Sonnet 4.6'dan çok daha güçlü olduğunu söylüyor. Dokümantasyon, geliştiricilerin token sayıları, uyarlanabilir düşünme ve örnekleme parametresi değişikliklerine dikkat etmesi gerektiğini belirtiyor. Güvenlik hikayesi ise Anthropic'in Sonnet 5'i günlük ajanlar için güçlü yapmak istediğini, ancak ona Opus veya Mythos ile aynı siber profili vermediğini söylüyor.

Bu pratik bir lansman. Onu pratik bir model gibi test edeceğim.

1 Temmuz 2026'da kontrol edilen kaynaklar