Клод Фейбл 5 повертається: Бенчмарки та моя думка
Tech
Claude Fable 5
Anthropic
AI Models
Claude Code

Клод Фейбл 5 повертається: Бенчмарки та моя думка

Клод Фейбл 5 повертається на глобальному рівні після скасування експортних обмежень. Ось бенчмарки, нові заходи безпеки та чому я скучив за цією моделлю.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
Оновлено 26 лип. 2026 р.
6 min read

Я скучив за Клодом Фейблом 5 більше, ніж очікував.

Це звучить дивно, коли говориш про модель, яка мала безладний запуск, була відкликана і стала об'єктом експортних обмежень та аргументів щодо кібербезпеки протягом кількох днів. Але Фейбл 5 була тією моделлю Клода, яку я хотів для роботи з агентами: перевірка репозиторіїв, довгі цикли кодування, використання інструментів, налагодження та виконання завдань, де модель повинна продовжувати працювати, не перетворюючи робочий процес на шум.

Антропік тепер говорить, що Фейбл 5 повертається на глобальному рівні. Коротка версія: уряд США застосував експортні обмеження до Клода Фейбла 5 та Клода Міфос 5 12 червня 2026 року. Антропік призупинив доступ, оскільки не міг перевірити національність в реальному часі. 30 червня Антропік заявив, що ці експортні обмеження були зняті, і Фейбл 5 почне повертатися на глобальному рівні в середу, 1 липня 2026 року.

Я радий, що цей розділ майже закінчився. Я хочу знову протестувати модель у звичайній роботі, а не читати ще один тиждень спекуляцій про те, чи повернеться вона взагалі.

Чому Клод Фейбл 5 важливий

Фейбл 5 - це не просто ще одне оновлення маленької моделі. Антропік описує її як модель класу Міфос, зроблену безпечнішою для загального використання. Це означає, що основна здатність близька до більш обмеженого Міфос 5, але Фейбл 5 постачається з більш сильними заходами безпеки та класифікаторами.

Запускові бенчмарки пояснюють, чому людям було так важливо, коли доступ зник.

Таблиця бенчмарків Клод Фейбл 5 та Міфос 5 від Антропік
Таблиця бенчмарків Клод Фейбл 5 та Міфос 5 від Антропік
БенчмаркКлод Міфос 5 / Фейбл 5Клод Опус 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

Зірочки мають значення. Антропік говорить, що деякі зіркові бенчмарки показують більшу різницю між Міфос 5 і Фейбл 5, оскільки заходи безпеки та поведінка резервування впливають на Фейбл. Тому я не сприймав би таблицю як чисту сирий потенціал моделі для кожного запиту користувача. Я б сприймав це як причину, чому Фейбл 5 стала такою цікавою: вона близька до рівня Міфос, але все ще є моделлю, до якої Антропік хоче, щоб звичайні користувачі та розробники мали доступ.

Для моєї власної роботи найсильніші сигнали - це SWE-bench Pro, Terminal-Bench 2.1 та OSWorld-Verified. Вони ближче до агентного кодування та робочих процесів комп'ютерного використання, ніж загальні бенчмарки чату. Фейбл 5 виглядає так, ніби вона створена для довгих, безладних завдань, де модель повинна перевіряти стан, використовувати інструменти, відновлюватися після помилок і зберігати достатньо контексту, щоб завершити.

Нова угода щодо заходів безпеки

Повернення не є простим перемиканням назад.

Антропік говорить, що він навчав покращений класифікатор безпеки після того, як звіт Amazon показав спосіб обійти заходи безпеки Фейбл 5 щодо запитів, пов'язаних з вразливістю. Антропік стверджує, що звіт не розкрив унікальної кіберздатності рівня Міфос, але компанія все ж вирішила заблокувати описану поведінку.

Новий класифікатор блокує конкретну техніку з того звіту у більше ніж 99% випадків, згідно з Антропік. Коли запит блокується, користувач повинен бути сповіщений, і запит може перейти до Клода Опус 4.8.

Діаграма Антропік, що показує звичайні заходи безпеки проти заходів безпеки Фейбл 5
Діаграма Антропік, що показує звичайні заходи безпеки проти заходів безпеки Фейбл 5

Це резервування важливе. Це означає, що деяка рутинна робота з кодування та налагодження може спочатку не потрапити до Фейбл 5. Якщо класифікатор вважає запит занадто близьким до кібербезпеки, навіть коли намір користувача безпечний, завдання може перейти до Опус 4.8 замість цього.

Я очікую, що це буде дратувати розробників у короткостроковій перспективі. Налагодження реальних систем часто стосується авторизації, мереж, ін'єкцій, залежностей, журналів та мови вразливостей. Обережний класифікатор може легко сплутати захисну інженерію з неналежним використанням. Антропік говорить, що він уточнить класифікатори протягом наступних тижнів, щоб зменшити кількість хибнопозитивних результатів.

Це правильний компроміс, якщо альтернатива - знову втратити доступ до Фейбл 5. Проте практичне питання не в тому, чи є класифікатор філософськи правильним. Питання в тому, чи дозволяє він продовжувати звичайну програмну роботу, не змушуючи кожне завдання, пов'язане з безпекою, переходити на іншу модель.

Серйозність злому потребує спільної мови

Більш цікавим політичним кроком є рамки, які Антропік розробляє разом з Amazon, Microsoft, Google та іншими партнерами Glasswing. Мета - спільний спосіб оцінити, наскільки серйозним є злому AI та як постачальники моделей повинні реагувати.

Діаграма Антропік, що показує категорії злому: незначний, вузько шкідливий та універсальний
Діаграма Антропік, що показує категорії злому: незначний, вузько шкідливий та універсальний

Запропоновані критерії Антропік є розумними:

приріст можливостей
широта приросту можливостей
легкість озброєння
виявлення

Це важливо, оскільки не кожен злому має однаковий ризик. Запит, який лише відновлює низькоризикову поведінку всередині меж безпеки класифікатора, не є тим самим, що й універсальний злому, який відкриває широкий клас шкідливих можливостей. Ставлення до обох як до одного й того ж типу надзвичайної ситуації створює погані стимули. Лабораторії або надмірно реагують на незначні знахідки, або недостатньо пояснюють великі.

Спільна шкала серйозності не вирішить питання безпеки прикордонних моделей сама по собі. Але принаймні зробить розмову менш хаотичною.

Моя думка

Я хочу, щоб Фейбл 5 повернувся, тому що хочу модель, яка здається вартою резервування для важкого проходу.

Рекомендовано для вас

Сонет 5 тепер є розумним щоденним драйвером. Я писав про це в моїй статті про бенчмарки Клод Сонет 5. Вона дешевша, практична і достатньо сильна для багатьох агентних циклів. Опус 4.8 все ще виглядає корисним як надійна резервна та оглядова модель.

Фейбл 5 займає іншу позицію. Я б використовував її, коли завдання є дорогим в будь-якому випадку: ризикована міграція, завислий баг, глибокий огляд репозиторію, довгий агентний робочий процес або частина аналізу, де модель повинна утримувати багато рухомих частин одночасно.

Мені також подобається, що Антропік не робить вигляд, що повторне розгортання є безперешкодним. Компанія говорить, що нові класифікатори створять деякі хибнопозитивні результати. Це краще, ніж продавати повернення, як ніби нічого не сталося.

Тест зараз простий: чи може Фейбл 5 повернутися, не ставши занадто чутливим для реальної інженерної роботи?

Якщо відповідь так, я радий, що це закінчилося. Я скучив за моделлю і хочу повернути її в робочі процеси, де Сонет хороший, але недостатній.

Джерела, перевірені 1 липня 2026 року