Клод Сонет 5 вже тут: Тестування, ціни та мій перший огляд
Tech
Claude Sonnet 5
Anthropic
AI Models
Claude Code

Клод Сонет 5 вже тут: Тестування, ціни та мій перший огляд

Клод Сонет 5 офіційно представлений. Тестування показує, що нова модель Сонет стає ближчою до роботи агентів класу Opus, з важливими обмеженнями.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Оновлено 25 лип. 2026 р.
7 min read

Клод Сонет 5 — це модель, яку я очікував, що Anthropic випустить після драми з Fable 5: менш драматична, ніж Mythos, більш практична, ніж невелике оновлення, і явно орієнтована на щоденну роботу агентів.

Anthropic запустив Клод Сонет 5 30 червня 2026 року. Головна новина не в тому, що Сонет раптом перевершує кожну модель класу Opus. Це не так. Корисна історія — це співвідношення ціни та продуктивності. Сонет 5 наближається до Opus 4.8 у роботі агентів, зберігає ціни Сонета і стає новою стандартною моделлю для багатьох користувачів Клода.

Це важливо для того, як я використовую AI-агентів. Мене менше цікавлять одноразові відповіді в чаті і більше те, чи може модель перевірити репозиторій, використовувати інструменти, залишатися в курсі завдання і завершити роботу без безладу.

Знімок тестування

Таблиця запуску Anthropic порівнює Сонет 5 з Сонетом 4.6 і Opus 4.8. Шаблон очевидний: Сонет 5 — це справжній стрибок у порівнянні з Сонетом 4.6, але Opus 4.8 все ще попереду в деяких з найскладніших агентських завдань.

Таблиця тестування Клод Сонет 5 від Anthropic, що порівнює Сонет 5, Сонет 4.6 та Opus 4.8
Таблиця тестування Клод Сонет 5 від Anthropic, що порівнює Сонет 5, Сонет 4.6 та Opus 4.8
ТестуванняСонет 5Сонет 4.6Opus 4.8
------:---:---:
SWE-bench Pro63.2%58.1%69.2%
Terminal-Bench 2.180.4%67.0%82.7%
Останній екзамен людства, без інструментів43.2%34.6%49.8%
Останній екзамен людства, з інструментами57.4%46.8%57.9%
OSWorld-Verified81.2%78.5%83.4%
GDPval-AA v2161813951615

Найсильніший сигнал — це Terminal-Bench 2.1. Сонет 5 стрибає з 67.0% Сонета 4.6 до 80.4%, близько до Opus 4.8 на 82.7%. Це той тип закриття прогалини, який важливий для кодуючих агентів, оскільки термінальна робота карає моделі, які не можуть планувати, відновлюватися і використовувати інструменти.

SWE-bench Pro є більш консервативним. Сонет 5 покращується в порівнянні з Сонетом 4.6, але Opus 4.8 залишається попереду. Я б розглядав це як відповідь на закупівлю, а не як відповідь на гіперболу: використовуйте Сонет 5 для звичайних агентських запусків, зберігайте Opus для випадків, коли додаткова надійність варта ціни.

Співвідношення ціни та продуктивності — це справжня історія запуску

Anthropic також опублікував графіки співвідношення ціни та продуктивності для BrowseComp і OSWorld-Verified на різних рівнях зусиль. Це більш корисно, ніж єдиний верхній бал, оскільки Сонет 5 тепер надає командам регулятор: витрачайте менше на середні зусилля або підвищуйте зусилля, коли завдання цього вимагає.

Графік співвідношення ціни та продуктивності агентського пошуку Клод Сонет 5 на BrowseComp
Графік співвідношення ціни та продуктивності агентського пошуку Клод Сонет 5 на BrowseComp
Графік співвідношення ціни та продуктивності використання комп'ютера агентом Клод Сонет 5 на OSWorld-Verified
Графік співвідношення ціни та продуктивності використання комп'ютера агентом Клод Сонет 5 на OSWorld-Verified

Це саме те, де модель класу Сонет повинна вигравати. Opus існує для складнішого міркування, але більшість робочих процесів потребують достатньої інтелектуальної потужності за ціною, за якою ви можете повторно запускати агента. Налагодження, QA браузера, перевірка репозиторіїв, операції з контентом і невеликі автоматизаційні завдання всі виграють від моделі, яка є дешевшою в експлуатації без втрати теми на півдорозі.

Anthropic стверджує, що Сонет 5 доступний за вступними цінами API у $2 за мільйон вхідних токенів і $10 за мільйон вихідних токенів до 31 серпня 2026 року. Після цього ціна зросте до $3 за вхід і $15 за вихід за мільйон токенів. Ця стандартна ціна відповідає ціні Сонета 4.6 за токен, але є підводний камінь: документація говорить, що Сонет 5 використовує новий токенізатор, який виробляє приблизно на 30% більше токенів для того ж тексту.

Отже, я б не називав міграцію автоматично нейтральною за витратами. Я б перерахував запити перед тим, як перемістити довготривалі агенти з Сонета 4.6 на Сонет 5.

Що змінюється для розробників

ID моделі — `claude-sonnet-5`. Anthropic описує її як просте оновлення з Сонета 4.6, але документація містить зміни в поведінці, які важливі в реальних додатках.

По-перше, адаптивне мислення увімкнено за замовчуванням. Якщо ви не передасте поле мислення, Сонет 5 все ще працює з адаптивним мисленням. Ви можете вимкнути його, але за замовчуванням це змінилося.

По-друге, ручне розширене мислення зникло. Старий шаблон `thinking: { type: "enabled", budget_tokens: N }` повертає 400. Anthropic хоче, щоб розробники використовували адаптивне мислення з параметром зусиль замість цього.

По-третє, параметри вибірки, що не є стандартними, відхиляються. Запити, які встановлюють `temperature`, `top_p` або `top_k` на нестандартні значення, повертають 400. Це реальна проблема міграції, якщо ваші обгортки автоматично встановлюють стандартні параметри вибірки.

Хороша новина: Сонет 5 підтримує контекстне вікно в 1M токенів за замовчуванням і до 128k вихідних токенів. Для роботи на рівні репозиторію та довгих контекстних робочих процесів це дає агентам більше простору для перевірки перед редагуванням.

Безпека та кібернетичні тестування

Anthropic позиціонує Сонет 5 як більш безпечний для звичайного використання агентами, ніж Сонет 4.6. У пості про запуск сказано, що Сонет 5 має нижчий рівень небажаної поведінки, ніж Сонет 4.6, і є безпечнішим у агентських контекстах.

Кібернетична таблиця є більш важливим обмеженням. Anthropic стверджує, що не навчав Сонет 5 на завданнях з кібербезпеки. На оцінці розробки експлойтів Firefox 147 Сонет 5 жодного разу не створив повноцінний експлойт. Він отримав 0.0% за успіхом робочого експлойту та 13.2% за частковий успіх. Opus 4.8 і Mythos 5 значно сильніші в цій оцінці, що саме тому Anthropic зберігає різні політики доступу та охорони навколо моделей з високим ризиком.

Оцінка розробки експлойтів Firefox 147 Клод Сонет 5 від Anthropic
Оцінка розробки експлойтів Firefox 147 Клод Сонет 5 від Anthropic

Це формулювання має сенс. Сонет 5 повинен бути достатньо потужним для звичайного кодування та роботи агентів, але не оптимізованим для небезпечних кіберздатностей. Anthropic також стверджує, що Сонет 5 запускається з увімкненими засобами кібербезпеки в реальному часі за замовчуванням.

Мій перший огляд

Я б розглядав Клод Сонет 5 як нову стандартну робочу модель для агентів Клода.

Це не та модель, яку я б обрав для кожної складної проблеми коду. Opus 4.8 все ще виграє в деяких агентських тестах кодування та використання комп'ютера. Fable 5 все ще є більш драматичною історією на передньому краї. Але Сонет 5 потрапляє в ту частину ринку, яку більшість будівельників насправді відчувають: ціна, контекст, використання інструментів і чи продовжує агент працювати.

Для Клод Код це, напевно, найцікавіший аспект. Дешевша модель, яка може працювати довше, краще використовувати інструменти і залишатися близькою до Opus у багатьох завданнях, змінює економіку агентських циклів. Ви можете резервувати моделі класу Opus для перевірки, складного налагодження або змін з високим ризиком, використовуючи Сонет 5 для основного виконання.

Ось як я б спробував це спочатку:

брудний репозиторій
невдале складання
завдання QA браузера
міграція з довгим контекстом
робочий процес з контентом з реальними посиланнями та зображеннями
невеликий крок розгортання, що вимагає стриманості
Рекомендовано для вас

Модель, яка добре оцінюється в тестах, все ще повинна вести себе в реальному робочому процесі. Вона повинна читати поточні файли, уникати не пов'язаних редагувань, виконувати перевірки і зупинятися, коли наступний крок потребує людського рішення. Я писав про цей стиль роботи в моїй статті Клод Код /loop і /goal.

Висновок

Клод Сонет 5 виглядає як відповідь Anthropic на співвідношення ціни та продуктивності для ери агентів. Він звужує прогалину до Opus 4.8, не намагаючись замінити його всюди.

Тести показують, що він значно сильніший за Сонет 4.6 у термінальній роботі, використанні інструментів, використанні комп'ютера, знаннєвій роботі та міркуванні. Документація говорить, що розробники повинні стежити за кількістю токенів, адаптивним мисленням і змінами параметрів вибірки. Історія безпеки говорить, що Anthropic хоче, щоб Сонет 5 був потужним для повсякденних агентів, не надаючи йому такого ж кіберпрофілю, як у Opus чи Mythos.

Це практичний запуск. Я протестую його як практичну модель.

Джерела, перевірені 1 липня 2026 року