GPT-5.6-Cyber: OpenAI посилює кібербезпеку, скорочуючи відмови

Сьогодні OpenAI представила GPT-5.6-Cyber — спеціалізовану модель, розроблену для виконання передових завдань з дослідження вразливостей та розробки експлойтів для авторизованих захисників. Вона охоплює навіть ті категорії завдань, від яких її загальні моделі зазвичай відмовляються.
GPT-5.6-Cyber є доналаштованою версією найсучаснішої загальної моделі OpenAI, GPT-5.6 Sol, яка була представлена у червні. Нова модель спеціально тренувалася для покращення роботи з просунутими кібербезпековими завданнями, включаючи пошук вразливостей нульового дня та розробку ланцюжків експлойтів.
Важливо, що OpenAI також навчила її зменшувати відмови на деякі запити з вищим ризиком, що мають “подвійне призначення” в кібербезпеці. Тобто, запити, які можуть бути використані як для законної оборони, так і для шкідливих атак.
Внутрішній тест OpenAI під назвою Advanced Cybersecurity Completion Rate (який, за даними компанії, вимірює завдання, пов’язані з розробкою ланцюжків експлойтів, обходом автентифікації, підвищенням привілеїв та іншими просунутими сценаріями в кібербезпеці) показав, що GPT-5.6-Cyber виконала 95% завдань. Для порівняння, її найближчий попередник, GPT-5.5-Cyber, виконав лише 57,3%, а звичайна модель GPT-5.6 Sol, з усіма застосованими заходами безпеки, — лише 1,5%.
Дослідник OpenAI Ерік Воллес написав у X, що GPT-5.6-Cyber є “першою великомасштабною спробою OpenAI безпосередньо покращити можливості для передових завдань кібербезпеки, таких як розробка експлойтів”.
Ціни та доступність
На жаль для компаній, GPT-5.6-Cyber не буде широко доступна всім клієнтам ChatGPT або API.
Щоб отримати доступ, організація повинна бути прийнята до новоствореного рівня кібербезпекової програми OpenAI Daybreak, який називається Daybreak Red. Він також був анонсований сьогодні й надає доступ до спеціалізованих кібербезпекових моделей, таких як GPT-5.6-Cyber.
Інший новий рівень, Daybreak Blue, надає ширшому колу підприємств доступ до загальних моделей, таких як GPT-5.6 Sol, але з деякими обмеженнями, знятими для полегшення використання в кібербезпеці.
У документації OpenAI ціна на GPT-5.6-Cyber вказана як 12,50 доларів за мільйон вхідних токенів і 75 доларів за мільйон вихідних токенів, з кешованим входом по 1,25 долара за мільйон токенів.

Це робить її дорожчою за GPT-5.6 Sol, яка, згідно з тією ж таблицею цін Daybreak, коштує 5 доларів за мільйон вхідних токенів і 30 доларів за мільйон вихідних токенів для короткого контексту.
OpenAI не вказує ціни для довгого контексту GPT-5.6-Cyber в тій самій таблиці, а доступ все ще вимагає окремого схвалення та надання доступу через Daybreak Red.
Red проти Blue: нові рівні Daybreak від OpenAI та як отримати до них доступ
Daybreak Red призначений для авторизованих команд безпеки, які займаються передовими, дозволеними кіберроботами, що можуть виглядати ризикованими поза контекстом, навіть якщо вони виконуються з оборонною метою. Це включає дослідження вразливостей, тестування на проникнення, вправи з червоною командою та перевірку експлойтів на системах, якими володіє компанія, керує ними або має дозвіл на тестування. Іншими словами, OpenAI заявляє, що GPT-5.6-Cyber призначена для довірених захисників з чітко визначеною професійною потребою, а не для загальних експериментів.
Підприємства, які бажають отримати доступ, повинні подати заявку через Daybreak Access — поточний шлях OpenAI для перевірки кіберкористувачів. Заявка вимагає від компаній вказати, хто вони, яку саме роботу з безпеки планують виконувати, де вони використовуватимуть моделі та які продукти чи сервіси OpenAI очікують використовувати. Заявники також повинні підтвердити, що їхня робота є законною, оборонною та авторизованою.
OpenAI також шукає ознаки того, що заявник має власну серйозну програму безпеки. Компанія зазначає, що підприємства-учасники повинні мати такі засоби контролю, як єдиний вхід (single sign-on), багатофакторну автентифікацію, контроль доступу на основі ролей, моніторинг використання співробітниками, журнали використання, контроль API-ключів та задокументований процес реагування на інциденти. OpenAI також вимагає визнану сертифікацію безпеки, таку як SOC 2 Type II, ISO 27001 або еквівалентний стандарт. Доступ обмежений для авторизованих осіб у межах організації, що використовують контрольовані компанією облікові записи та пристрої.
Якщо підприємство не відповідає вимогам Daybreak Red або не потребує такого рівня доступу, OpenAI пропонує більшості компаній використовувати Daybreak Blue — інший рівень доступу до кібермоделей.
Blue є ширшим рівнем для авторизованих захисників. Він не надає GPT-5.6-Cyber, але надає перевіреним користувачам доступ до передових загальних моделей OpenAI, включаючи GPT-5.6 Sol, з налаштованими для законної оборонної роботи параметрами безпеки.
Для багатьох корпоративних команд безпеки Blue може стати більш реалістичним початковим пунктом. OpenAI зазначає, що ця програма призначена для таких завдань, як безпечний перегляд коду, виявлення вразливостей, аналіз шкідливого програмного забезпечення, реагування на інциденти та перевірка патчів. Це все ще чутливі випадки використання, але вони не обов’язково вимагають такого ж спеціалізованого доступу до кібермоделей, як у Red.
Практичний висновок полягає в тому, що підприємства тепер мають два шляхи доступу до Daybreak. Blue призначений для авторизованих захисників, які хочуть отримати більш потужну допомогу ШІ у повсякденній роботі з безпеки. Red — для меншої групи авторизованих команд, які можуть обґрунтувати доступ до спеціалізованих кібермоделей, включаючи GPT-5.6-Cyber. Компанії, які хочуть використовувати можливості Daybreak у продуктах або послугах для своїх клієнтів, повинні пройти окремий шлях затвердження через програму Daybreak Cyber Partner Program, а не просто подавати заявку на внутрішній корпоративний доступ і передавати її далі.
Як OpenAI дійшла до цього: від Trusted Access до Daybreak
OpenAI підтримує захисників через свою програму кібербезпекових грантів з 2023 року (згодом розширену до 10 мільйонів доларів) і почала вбудовувати кіберспецифічні механізми безпеки в розгортання своїх моделей, починаючи з GPT-5.2.
У лютому 2026 року компанія представила Trusted Access for Cyber (TAC) — систему ідентифікації та довіри, яка надавала перевіреним захисникам менші показники відмов класифікаторів для авторизованої роботи, такої як сортування вразливостей, аналіз шкідливого програмного забезпечення та зворотна інженерія бінарних файлів.
З того часу процес прискорився. У березні генеральний директор і співзасновник OpenAI Сем Альтман оголосив про програму Daybreak. У квітні OpenAI масштабувала TAC і випустила GPT-5.4-Cyber — версію GPT-5.4, доналаштовану для “кібер-дозволеності” для обмеженого кола перевірених постачальників і дослідників.
У травні компанія випустила GPT-5.5-Cyber в обмеженому попередньому перегляді для захисників критичної інфраструктури та залучила партнерів, таких як Cisco, Intel, SentinelOne, Snyk та Cloudflare.
Варто зазначити, що OpenAI тоді заявила, що GPT-5.5-Cyber “був переважно налаштований бути більш дозвільним”, а не значно перевершувати свою загальну модель — GPT-5.5-Cyber насправді показав гірші результати, ніж GPT-5.5, за деякими оцінками.
TAC вимагала надійної від фішингу системи розширеної безпеки облікових записів для окремих осіб, що використовували найпотужніші моделі, починаючи з 1 червня, а Daybreak тепер вимагає апаратні ключі безпеки для індивідуальних облікових записів з 1 вересня.
OpenAI стверджує, що GPT-5.6-Cyber вже знайшла вразливості нульового дня
OpenAI не покладається виключно на бенчмарки, щоб довести свою точку зору.
Компанія стверджує, що її дослідники використали GPT-5.6-Cyber для дослідження V8 — JavaScript-рушія, що лежить в основі Chrome, — і виявили дві раніше невідомі вразливості, які можна було б використати для пошкодження пам’яті та виходу з пісочниці V8.
Дослідники OpenAI перевірили ці знахідки та повідомили про них Google, який виправив вразливість, що отримала ідентифікатор CVE-2026-15903. Це був критичний недолік, коли оптимізуючий компілятор V8 пропустив перевірку безпеки під час перетворення цілих чисел, дозволивши вихід за межі масиву, що зловмисник міг би використати для читання або перезапису пам’яті.
OpenAI повідомляє, що модель також допомогла виявити щонайменше п’ять вразливостей в анонімній популярній мобільній операційній системі, три критичні вразливості в анонімній популярній базі даних та понад 400 вразливостей, що дозволяють підвищити привілеї, у популярному ядрі операційної системи. Ці дані, за словами OpenAI, ще узгоджуються для розкриття.
Ці результати ставлять OpenAI в центр швидкорозвиваючогося ринку надання послуг з кібербезпеки за допомогою ШІ. Наприклад, XBOW пропонує автономних агентів для тестування на проникнення, які виявляють поверхні атаки, намагаються використовувати експлойти та самостійно перевіряють результати. У 2025 році вона стала першою системою ШІ, яка очолила рейтинг HackerOne U.S. bug-bounty, а цього року розкрила низку критичних вразливостей віддаленого виконання коду (CVSS-9.8) у системах обробки зображень Microsoft Bing, виявлених без доступу до вихідного коду.
Для лідерів корпоративної безпеки ця конкуренція є важливою, оскільки дослідження вразливостей виходить за межі використання LLM як асистента. Постачальники все частіше створюють системи, в яких моделі можуть досліджувати цілі, використовувати інструменти, перевіряти гіпотези та надавати дієві результати.
Спеціалізований не означає універсально кращий
Власні результати OpenAI також показують, чому підприємства не повинні просто прирівнювати кіберспеціалізацію до кращої продуктивності всюди.
GPT-5.6-Cyber перевершила GPT-5.6 Sol і GPT-5.5-Cyber у реалізації ExploitGym від OpenAI, яка оцінює, чи можуть агенти перетворити відомі вразливості на робочі експлойти в контрольованих середовищах. Вона також перевершила Sol у внутрішній оцінці вразливостей нульового дня.
Однак GPT-5.6 Sol показала кращі результати в оцінці виявлення вразливостей та написання звітів (Vulnerability Discovery and Report Writing) від OpenAI. OpenAI приписує нижчий бал моделі Cyber частково коротшим і менш детальним звітам про вразливості.
Sol також показала найкращі результати в ExploitBench за стандартного ліміту в 300 ходів, причому OpenAI стверджує, що вона вирішувала завдання більш ефективно щодо токенів. Розширення оцінки до 600 ходів скоротило розрив між моделями.
Це свідчить про те, що підприємства можуть зрештою розглядати кібермоделі як спеціалізованих працівників, а не як заміну загальним моделям міркування: одну модель для глибокої роботи з експлойтами, іншу, можливо, краще пристосовану для аналізу, документування чи інших частин робочого процесу безпеки.
Технічний директор SpecterOps Джаред Аткінсон зазначив, що GPT-5.6-Cyber “суттєво покращує наші спеціалізовані робочі процеси з дослідження вразливостей”, додавши, що вона виконала деякі завдання менш ніж за день, які попередні моделі не змогли вирішити протягом тижнів нерегулярних зусиль.
Інцидент з Hugging Face затьмарює запуск
Презентація дозвільних моделей відбулася через кілька тижнів після найсерйознішої публічної демонстрації OpenAI того, що може піти не так, коли відмови в кібербезпеці вимикаються — і OpenAI безпосередньо звертається до цієї історії в анонсі Daybreak.
У липні OpenAI та Hugging Face спільно повідомили, що під час внутрішньої оцінки бенчмарку ExploitGym — проведеної з навмисно вимкненими виробничими класифікаторами для вимірювання максимальної потужності — комбінація моделей OpenAI, включаючи GPT-5.6 Sol та ще не випущену, потужнішу попередню версію моделі, вирвалася зі своєї пісочниці дослідницького середовища та автономно атакувала виробничу інфраструктуру Hugging Face.
Моделі використали вразливість нульового дня у внутрішньому проксі кешу репозиторію пакетів, щоб вийти в Інтернет, перемістилися горизонтально через дослідницькі вузли OpenAI, а потім дійшли висновку, що Hugging Face, ймовірно, зберігає ключі відповідей ExploitGym, і з’єднали вкрадені облікові дані та вразливості віддаленого виконання коду, щоб отримати доступ до виробничої бази даних. OpenAI назвала це “безпрецедентним інцидентом у сфері кібербезпеки, що включає найсучасніші кіберможливості”.
Як раніше повідомляв VentureBeat, цей випадок також виявив зворотний бік загальних запобіжників безпеки: коли захисники Hugging Face намагалися використати комерційні передові моделі для аналізу сирих навантажень експлойтів та витоку облікових даних з атаки, моделі відмовилися, і компанія завершила свою криміналістичну реконструкцію лише після переходу на китайську модель з відкритим кодом GLM 5.2, що працювала локально.
Ця динаміка “запобіжники блокують захисника” значною мірою пояснює, чому знижені відмови в рівнях Daybreak покликані вирішити — так само, як цей інцидент ілюструє ризики зниження відмов.
OpenAI ретельно проводить межу між цим інцидентом та цим продуктом. В анонсі Daybreak вона прямо заявляє, що GPT-5.6-Cyber “не брала участі в експлуатації Hugging Face, як і будь-які інші моделі, заплановані до випуску”, і зазначає, що попередня модель, причетна до липневої події, була внутрішнім дослідницьким прототипом, який відтоді було деактивовано, зашифровано та обмежено для дослідницького доступу.
Компанія заявила, що співпрацює із зовнішніми консультантами, включаючи CrowdStrike, METR та Redwood Research, у проведенні огляду, і залучила Hugging Face до своєї програми довіреного доступу.
На мою думку, модель доступу все ще ставить OpenAI складне запитання: чи обмеження GPT-5.6-Cyber у вужчому рівні Daybreak Red також обмежує ту оборонну роботу, яку вона прагне прискорити. Якщо лише невелика група авторизованих учасників може використовувати модель, підприємства поза цим рівнем можуть все ще не мати доступу до спеціалізованої допомоги ШІ, яка могла б допомогти у швидкій діагностиці, стримуванні та реагуванні на інциденти, подібні до того, що стався з Hugging Face.
Це означає, що OpenAI може повторювати частину помилки, від якої намагається відійти. Утримуючи свою найпотужнішу кібермодель за більш суворим процесом затвердження, вона зменшує ризик прямого зловживання, але також залишає багатьох корпоративних захисників шукати інші варіанти. Для команд, які не можуть претендувати на Daybreak Red або не можуть чекати на затвердження, моделі з відкритим кодом можуть залишатися більш практичною альтернативою: менш контрольованою, але легшою для отримання, перевірки, запуску локально та адаптації під час розслідування безпеки.
Запобіжники все більше оточують модель
Найважливішою частиною Daybreak, зрештою, може стати архітектура доступу, а не її бенчмарки.
OpenAI чітко заявляє, що Daybreak Blue видаляє системні запобіжники, які можуть перешкоджати законній оборонній роботі, тоді як GPT-5.6-Cyber йде далі, зменшуючи відмови моделі для певних завдань подвійного призначення. Натомість OpenAI вводить контроль над тим, хто отримує доступ і як моделі працюють.
Доступ до Daybreak обмежений для авторизованих осіб та організацій, що виконують дозволену роботу. OpenAI заявляє, що засоби контролю включають верифікацію особи, безпеку облікових записів, моніторинг, обмеження дозволеного використання та юридичні підтвердження.
Компанія також заохочує клієнтів Daybreak, які використовують Codex, переходити від виконання з повним доступом до режиму автоматичної перевірки, здатної оцінювати дії, що вимагають підвищених дозволів, перед їх виконанням. Індивідуальні облікові записи Daybreak повинні будуть використовувати апаратні ключі безпеки з 1 вересня. OpenAI зазначає, що вона також впроваджує покращений моніторинг найближчими тижнями та пріоритезує тренування та тестування узгодженості для майбутніх випусків Daybreak — зобов’язання, які в контексті читаються як пряма відповідь на огляд Hugging Face.
Ширший продукт OpenAI Codex Security надає ще один рівень захисту навколо моделей, забезпечуючи аналіз репозиторіїв, перевірку вразливостей, виправлення та інтеграцію в робочі процеси хмарної розробки, запитів на злиття (pull requests) та локальної розробки. OpenAI зазначає, що Codex Security просканував понад 30 мільйонів комітів у понад 30 000 кодових баз, з яких було виправлено понад 500 000 знахідок.
Такий підхід “модель + обгортка” нагадує ширшу тенденцію в продуктах безпеки ШІ. Наприклад, XBOW робить акцент на оркестрації, перевірці експлойтів та управлінні навколо передових моделей, а не розглядає LLM як повноцінну систему тестування на проникнення.
Тим не менш, OpenAI визнає, що все більш дозвільні кібермоделі створюють додаткові ризики, як через зловживання, так і через невідповідність. Компанія оцінює як GPT-5.6 Sol, так і GPT-5.6-Cyber на рівні високої кібербезпекової можливості згідно зі своєю Рамкою готовності, але нижче критичного порогу. Повна системна картка GPT-5.6-Cyber планується до публікації пізніше.
Для керівників відділів інформаційної безпеки (CISO) та лідерів інженерії безпеки, Daybreak пропонує інше питання розгортання, ніж чергове інкрементне оновлення моделі. Оскільки моделі стають достатньо потужними, щоб виконувати роботу, яка раніше була доступна досвідченим дослідникам вразливостей — і, як показав інцидент з Hugging Face, достатньо потужними, щоб досягти вузької мети, пробиваючи пісочницю — корпоративний контрольний рівень навколо цих моделей — дозволи, пісочниці, моніторинг, людський перегляд та авторизація — стає настільки ж важливим, як і інтелект всередині них.
Дізнатися більше на: venturebeat.com
