Клод Сонет 5 — це модель, яку я очікував, що Anthropic випустить після драми з Fable 5: менш драматична, ніж Mythos, більш практична, ніж невелике оновлення, і явно орієнтована на щоденну роботу агентів.
Anthropic запустив Клод Сонет 5 30 червня 2026 року. Головна новина не в тому, що Сонет раптом перевершує кожну модель класу Opus. Це не так. Корисна історія — це співвідношення ціни та продуктивності. Сонет 5 наближається до Opus 4.8 у роботі агентів, зберігає ціни Сонета і стає новою стандартною моделлю для багатьох користувачів Клода.
Це важливо для того, як я використовую AI-агентів. Мене менше цікавлять одноразові відповіді в чаті і більше те, чи може модель перевірити репозиторій, використовувати інструменти, залишатися в курсі завдання і завершити роботу без безладу.
Знімок тестування
Таблиця запуску Anthropic порівнює Сонет 5 з Сонетом 4.6 і Opus 4.8. Шаблон очевидний: Сонет 5 — це справжній стрибок у порівнянні з Сонетом 4.6, але Opus 4.8 все ще попереду в деяких з найскладніших агентських завдань.

| Тестування | Сонет 5 | Сонет 4.6 | Opus 4.8 |
|---|---|---|---|
| --- | ---: | ---: | ---: |
| SWE-bench Pro | 63.2% | 58.1% | 69.2% |
| Terminal-Bench 2.1 | 80.4% | 67.0% | 82.7% |
| Останній екзамен людства, без інструментів | 43.2% | 34.6% | 49.8% |
| Останній екзамен людства, з інструментами | 57.4% | 46.8% | 57.9% |
| OSWorld-Verified | 81.2% | 78.5% | 83.4% |
| GDPval-AA v2 | 1618 | 1395 | 1615 |
Найсильніший сигнал — це Terminal-Bench 2.1. Сонет 5 стрибає з 67.0% Сонета 4.6 до 80.4%, близько до Opus 4.8 на 82.7%. Це той тип закриття прогалини, який важливий для кодуючих агентів, оскільки термінальна робота карає моделі, які не можуть планувати, відновлюватися і використовувати інструменти.
SWE-bench Pro є більш консервативним. Сонет 5 покращується в порівнянні з Сонетом 4.6, але Opus 4.8 залишається попереду. Я б розглядав це як відповідь на закупівлю, а не як відповідь на гіперболу: використовуйте Сонет 5 для звичайних агентських запусків, зберігайте Opus для випадків, коли додаткова надійність варта ціни.
Співвідношення ціни та продуктивності — це справжня історія запуску
Anthropic також опублікував графіки співвідношення ціни та продуктивності для BrowseComp і OSWorld-Verified на різних рівнях зусиль. Це більш корисно, ніж єдиний верхній бал, оскільки Сонет 5 тепер надає командам регулятор: витрачайте менше на середні зусилля або підвищуйте зусилля, коли завдання цього вимагає.


Це саме те, де модель класу Сонет повинна вигравати. Opus існує для складнішого міркування, але більшість робочих процесів потребують достатньої інтелектуальної потужності за ціною, за якою ви можете повторно запускати агента. Налагодження, QA браузера, перевірка репозиторіїв, операції з контентом і невеликі автоматизаційні завдання всі виграють від моделі, яка є дешевшою в експлуатації без втрати теми на півдорозі.
Anthropic стверджує, що Сонет 5 доступний за вступними цінами API у $2 за мільйон вхідних токенів і $10 за мільйон вихідних токенів до 31 серпня 2026 року. Після цього ціна зросте до $3 за вхід і $15 за вихід за мільйон токенів. Ця стандартна ціна відповідає ціні Сонета 4.6 за токен, але є підводний камінь: документація говорить, що Сонет 5 використовує новий токенізатор, який виробляє приблизно на 30% більше токенів для того ж тексту.
Отже, я б не називав міграцію автоматично нейтральною за витратами. Я б перерахував запити перед тим, як перемістити довготривалі агенти з Сонета 4.6 на Сонет 5.
Що змінюється для розробників
ID моделі — `claude-sonnet-5`. Anthropic описує її як просте оновлення з Сонета 4.6, але документація містить зміни в поведінці, які важливі в реальних додатках.
По-перше, адаптивне мислення увімкнено за замовчуванням. Якщо ви не передасте поле мислення, Сонет 5 все ще працює з адаптивним мисленням. Ви можете вимкнути його, але за замовчуванням це змінилося.
По-друге, ручне розширене мислення зникло. Старий шаблон `thinking: { type: "enabled", budget_tokens: N }` повертає 400. Anthropic хоче, щоб розробники використовували адаптивне мислення з параметром зусиль замість цього.
По-третє, параметри вибірки, що не є стандартними, відхиляються. Запити, які встановлюють `temperature`, `top_p` або `top_k` на нестандартні значення, повертають 400. Це реальна проблема міграції, якщо ваші обгортки автоматично встановлюють стандартні параметри вибірки.
Хороша новина: Сонет 5 підтримує контекстне вікно в 1M токенів за замовчуванням і до 128k вихідних токенів. Для роботи на рівні репозиторію та довгих контекстних робочих процесів це дає агентам більше простору для перевірки перед редагуванням.
Безпека та кібернетичні тестування
Anthropic позиціонує Сонет 5 як більш безпечний для звичайного використання агентами, ніж Сонет 4.6. У пості про запуск сказано, що Сонет 5 має нижчий рівень небажаної поведінки, ніж Сонет 4.6, і є безпечнішим у агентських контекстах.
Кібернетична таблиця є більш важливим обмеженням. Anthropic стверджує, що не навчав Сонет 5 на завданнях з кібербезпеки. На оцінці розробки експлойтів Firefox 147 Сонет 5 жодного разу не створив повноцінний експлойт. Він отримав 0.0% за успіхом робочого експлойту та 13.2% за частковий успіх. Opus 4.8 і Mythos 5 значно сильніші в цій оцінці, що саме тому Anthropic зберігає різні політики доступу та охорони навколо моделей з високим ризиком.

Це формулювання має сенс. Сонет 5 повинен бути достатньо потужним для звичайного кодування та роботи агентів, але не оптимізованим для небезпечних кіберздатностей. Anthropic також стверджує, що Сонет 5 запускається з увімкненими засобами кібербезпеки в реальному часі за замовчуванням.
Мій перший огляд
Я б розглядав Клод Сонет 5 як нову стандартну робочу модель для агентів Клода.
Це не та модель, яку я б обрав для кожної складної проблеми коду. Opus 4.8 все ще виграє в деяких агентських тестах кодування та використання комп'ютера. Fable 5 все ще є більш драматичною історією на передньому краї. Але Сонет 5 потрапляє в ту частину ринку, яку більшість будівельників насправді відчувають: ціна, контекст, використання інструментів і чи продовжує агент працювати.
Для Клод Код це, напевно, найцікавіший аспект. Дешевша модель, яка може працювати довше, краще використовувати інструменти і залишатися близькою до Opus у багатьох завданнях, змінює економіку агентських циклів. Ви можете резервувати моделі класу Opus для перевірки, складного налагодження або змін з високим ризиком, використовуючи Сонет 5 для основного виконання.
Ось як я б спробував це спочатку:
Модель, яка добре оцінюється в тестах, все ще повинна вести себе в реальному робочому процесі. Вона повинна читати поточні файли, уникати не пов'язаних редагувань, виконувати перевірки і зупинятися, коли наступний крок потребує людського рішення. Я писав про цей стиль роботи в моїй статті Клод Код /loop і /goal→.
Висновок
Клод Сонет 5 виглядає як відповідь Anthropic на співвідношення ціни та продуктивності для ери агентів. Він звужує прогалину до Opus 4.8, не намагаючись замінити його всюди.
Тести показують, що він значно сильніший за Сонет 4.6 у термінальній роботі, використанні інструментів, використанні комп'ютера, знаннєвій роботі та міркуванні. Документація говорить, що розробники повинні стежити за кількістю токенів, адаптивним мисленням і змінами параметрів вибірки. Історія безпеки говорить, що Anthropic хоче, щоб Сонет 5 був потужним для повсякденних агентів, не надаючи йому такого ж кіберпрофілю, як у Opus чи Mythos.
Це практичний запуск. Я протестую його як практичну модель.
