GPT-5.6 Sol офіційно представлено: що змінилося порівняно з Claude Fable 5
Tech
OpenAI
GPT-5.6
GPT-5.6 Sol
GPT-5.6 Sol Ultra

GPT-5.6 Sol офіційно представлено: що змінилося порівняно з Claude Fable 5

OpenAI GPT-5.6 Sol офіційно представлено. Ось що змінилося, що означає Sol Ultra, які бенчмарки доступні та як модель порівнюється з Claude Fable 5.

Uygar DuzgunUUygar Duzgun
Jun 26, 2026
Оновлено 22 серп. 2026 р.
7 min read

GPT-5.6 більше не чутки. OpenAI опублікувала GPT-5.6 Preview System Card 26 червня 2026 року, і важлива деталь полягає у форматі запуску: сімейство моделей, обмежені налаштування попереднього перегляду та значна увага до безпеки агентів.

Рекомендовано для вас

Два тижні тому я написав попередню перевірку чуток про GPT-5.6. На той момент стаття була правильною: GPT-5.6 ще не була публічно доступною. Сьогодні ситуація змінилася.

Мій висновок простий. GPT-5.6 — це відповідь OpenAI на той самий тиск, який Anthropic створила за допомогою Claude Fable 5: моделі оцінюють за тим, чи можуть вони виконувати реальну роботу, безпечно використовувати інструменти та залишатися надійними, коли завдання стає довгим і складним.

Що оголосила OpenAI

OpenAI описує GPT-5.6 як нове сімейство з трьома моделями: Sol, Terra та Luna. Sol — флагманська модель, Terra — доступніший варіант із широкими можливостями, а Luna — найшвидший і найекономніший представник сімейства.

OpenAI не розглядає це як звичайне оновлення чат-моделі. Компанія наголошує на складному міркуванні, програмуванні, роботі з комп’ютером, використанні інструментів, фактичності та безпечнішій поведінці агентів. Це правильний набір характеристик для спостереження, адже саме в цих сферах передові моделі або стають корисними операторами, або залишаються дорогим автодоповненням.

System card також містить корисні сигнали. OpenAI стверджує, що GPT-5.6 зменшує кількість серйозних фактичних помилок порівняно з GPT-5.5 у LongFact і знижує рівень галюцинацій в аналізі виробничого трафіку. Значну частину документа також присвячено prompt injection, випадковим діям, що можуть знищити дані, підтвердженням користувача під час роботи з комп’ютером, alignment і категоріям preparedness, зокрема кібернетичним та біологічним/хімічним ризикам.

Це свідчить про те, що OpenAI хоче, аби GPT-5.6 оцінювали як агентну платформу, а не лише як розумніший інструмент для відповідей.

Sol Ultra та сигнали бенчмарків

Є також аспект Sol Ultra, але тут варто формулювати обережно. OpenAI описує новий рівень міркування `max` для Sol і новий режим `ultra`, який використовує субагентів для пришвидшення складної роботи. Я сприймаю це як режим Sol із більшими обчислювальними ресурсами, а не як четверту базову модель. Базове сімейство в system card усе ще складається із Sol, Terra та Luna.

OpenAI заявляє, що опублікує ширший набір оцінювань, коли моделі стануть загальнодоступними. Наразі варто показати такі сигнали бенчмарків:

Бенчмарк або оцінюванняОпублікований сигнал GPT-5.6
------
Terminal-Bench 2.1OpenAI стверджує, що GPT-5.6 Sol встановлює новий state of the art у робочих процесах командного рядка, які потребують планування, ітерацій і координації інструментів.
GeneBench v1OpenAI стверджує, що Sol перевершує GPT-5.5 у довготривалих геномних і кількісно-біологічних робочих процесах, використовуючи менше токенів.
ExploitBenchOpenAI стверджує, що Sol конкурує з Mythos Preview, використовуючи приблизно третину вихідних токенів.
ExploitGymOpenAI стверджує, що Sol, Terra та Luna покращуються зі збільшенням рівня міркування.
Внутрішні завдання CTFУ system card зазначено, що GPT-5.6 Sol досягає насичення оцінювання на рівні 96,7%.
Irregular FrontierCyberGPT-5.6 Sol розв’язала 19 із 197 завдань; заявлений показник успішності становив 11% для Easy, 12% для Medium, 5% для Hard і 0% для Elite.
CyScenarioBench та Atomic ChallengesIrregular повідомила про 28% у CyScenarioBench. В Atomic Challenges Sol отримала 98% у Network Attack Simulation, 91% у Vulnerability Research and Exploitation і 56% у Evasion.

Це корисно, але ще не привід для фінального тріумфу. Більшість конкретних публічних показників стосується кібербезпеки. Загальні заяви щодо програмування та агентів звучать переконливо, але нам усе ще потрібне ширше незалежне тестування, перш ніж стверджувати, що Sol Ultra краща за Claude Fable 5 у звичайній програмній роботі.

Що схоже на Claude Fable 5

Claude Fable 5 просунулася до тієї самої межі, але в іншому стилі. Anthropic запустила її 9 червня як модель класу Mythos, доступну для загального використання. Anthropic позиціонувала Fable 5 для довгих і складних завдань: програмної інженерії, інтелектуальної роботи, роботи із зображеннями, наукових досліджень і довготривалої роботи агентів.

Схожість очевидна.

СфераGPT-5.6 SolClaude Fable 5
---------
Основна пропозиціяФлагманська модель для агентів і міркуванняФронтирна модель класу Mythos для загального використання
Найсильніші сценаріїПрограмування, використання інструментів, робота з комп’ютером, фактичність, агентиПрограмна інженерія, довгі завдання, інтелектуальна робота, робота із зображеннями
Підхід до безпекиPreview system card, категорії preparedness, робота над prompt injection та alignmentЗахисні механізми Fable, розподіл Mythos, резервна маршрутизація для чутливих сфер
Питання для покупцяЧи можу я довірити їй роботу з інструментами?Чи зможу я отримати доступ і зберігати стабільність як залежності?

Обидві компанії приходять до тієї самої продуктової істини: модель має працювати всередині системи. Вона повинна дотримуватися інструкцій, працювати з інструментами, уникати руйнівних дій і надавати командам достатньо доказів для довіри до результату.

Рекомендовано для вас

Саме ця частина цікавить мене в coding agents. Мені не потрібна ще одна модель, яка пише впевнений текст. Мені потрібна модель, яка може перевірити репозиторій, зрозуміти обмеження, виконати перевірки та зупинитися, перш ніж торкатися сторонньої роботи. Більше про такий стиль роботи я написав у своєму робочому процесі з цілями та циклами AI agent.

Чим відрізняються GPT-5.6 і Fable 5

Перша відмінність — доступ.

OpenAI починає запуск GPT-5.6 з налаштуваннями попереднього перегляду. Це обережний, але зрозумілий підхід. Anthropic запустила Fable 5 ширше, а потім 12 червня опублікувала заяву, що була змушена призупинити доступ до Fable 5 і Mythos 5 після директиви уряду США щодо експортного контролю. Anthropic зазначила, що доступ до інших моделей Claude не постраждав, але Fable 5 за одну ніч стала складною виробничою залежністю.

Це змінює порівняння. Модель може бути блискучою, але все одно непридатною як основа для розробки, якщо доступ до неї змінюється без звичайного перехідного періоду.

Друга відмінність — продуктовий акцент.

Історія Fable 5 від Anthropic була зосереджена насамперед на можливостях: сильніша довготривала робота, дуже великий контекст і розподіл між Fable 5 для загального використання та Mythos 5 для доступу до надійного кіберзахисту. Історія GPT-5.6 від OpenAI більше орієнтована на розгортання: сімейство моделей, налаштування попереднього перегляду, safety system card, робота над prompt injection і явна увага до сценаріїв відмови агентів.

Третя відмінність — тон.

Anthropic створила враження, що Fable 5 — це стрибок над попередньою лінійкою Claude. OpenAI позиціонує GPT-5.6 як безпечніший і надійніший операційний рівень для складної роботи. Це може звучати менш драматично, але саме тут виробничі AI agents найчастіше ламаються: дозволи інструментів, контроль контексту, фактичність, приховані побічні ефекти та здатність моделі визнавати невизначеність.

Мій практичний тест для GPT-5.6

Я не оцінював би GPT-5.6 Sol лише за стартовими графіками. Перший тест, який я хочу провести, — це реальне інженерне завдання:

неохайне git-дерево
застаріла документація
тести, що не проходять
помилка в кількох файлах
поверхня інструментів MCP
етап розгортання або публікації, що потребує обережності
Рекомендовано для вас

Хороша модель повинна спочатку читати, а вже потім редагувати, вносити найменшу безпечну зміну, перевіряти результат і повідомляти про блокери, а не вдавати, що все завершено. GPT-5.5 уже покращила цей підхід у Codex, про що я писав у своєму тесті GPT-5.5 Codex. GPT-5.6 має краще справлятися з нудними частинами: робити менше хибних припущень, чистіше викликати інструменти та надійніше зупинятися у правильний момент.

Рекомендовано для вас

Fable 5 усе ще важлива, оскільки встановила планку для довгої та складної роботи. Мій огляд запуску Claude Fable 5 у день релізу був позитивним саме з цієї причини. Проблема з доступом не стирає історію її можливостей, але додає урок щодо закупівель: вибір frontier AI тепер включає політичний ризик, а не лише ризик, пов’язаний із бенчмарками.

Вердикт

GPT-5.6 Sol виглядає як серйозна відповідь OpenAI на момент Fable 5. Моделі схожі за амбіціями: довгі завдання, програмування, агенти та безпечніше використання моделей із високими можливостями. Вони відрізняються стратегією запуску. Anthropic показала, як може відчуватися стрибок у можливостях. OpenAI намагається зробити наступний стрибок придатним для розгортання.

Sol Ultra робить запуск цікавішим, оскільки вказує на багатoагентне виконання, а не лише на глибше міркування однієї моделі. Але я все одно оцінюватиму її за виконаною роботою: перевіркою репозиторію, використанням інструментів, відновленням після помилок і тим, чи залишає вона чистий слід для людини, відповідальної за систему.

Для розробників переможцем є не модель із найгучнішим запуском. Переможцем є модель, яка може виконати реальну роботу, безпечно використовувати інструменти та залишити чистий audit trail.

Саме це я перевірю насамперед.

Джерела, перевірені 26 червня 2026 року

Публікація OpenAI про запуск: Previewing GPT-5.6 Sol, перевірено в браузері 26 червня 2026 року