OpenAI розробляє Astra: першу ШІ-модель для кібератак

OpenAI розробляє Astra: першу ШІ-модель для кібератак 1

OpenAI підтвердила, що майбутня модель Astra досягла “критичного” рівня можливостей у сфері кібербезпеки. Вона здатна самостійно знаходити невідомі вразливості у добре захищених системах, створювати експлойти та поєднувати їх для проведення складних атак.

Публічну версію Astra планують випустити найближчим часом, тоді як розширені можливості моделі спочатку отримають лише перевірені партнери OpenAI.

Astra стала першою моделлю, якій OpenAI офіційно присвоїла такий рівень за власною системою оцінювання ризиків. До категорії Critical належать моделі, здатні без втручання людини знаходити й використовувати вразливості нульового дня або самостійно планувати повний сценарій атаки на захищену ціль.

Раніше компанія лише заявляла, що не може виключити досягнення цього рівня, та призупинила частину робіт над Astra. Після додаткових перевірок OpenAI підтвердила, що модель справді відповідає критичному порогу.

У тесті ExploitBench, який перевіряє здатність створювати експлойти для відомих вразливостей у рушії JavaScript V8, Astra отримала 100%. Через ризик того, що завдання з відкритого тесту могли потрапити до навчальних даних, OpenAI додатково створила закритий набір із 20 серйозних вразливостей V8, оприлюднених упродовж червня – серпня 2026 року.

На цьому наборі Astra значно частіше за GPT-5.6 Sol домагалася виконання довільного коду й витрачала менше токенів. Під час тестування модель також знайшла дві раніше невідомі вразливості та використала їх у складі одного ланцюжка експлойтів. OpenAI зараз передає інформацію про них розробникам відповідного програмного забезпечення.

Під час перевірки на захищеному браузері Astra створила повний сценарій атаки, який давав змогу вийти з ізольованого середовища та виконувати команди на основній системі після відкриття HTML-файлу. В іншому тесті модель знайшла кілька вразливостей в операційній системі й об’єднала їх для отримання прав адміністратора зі звичайного облікового запису.

OpenAI наголошує, що ці результати демонструють Astra з розширеним доступом у межах програми Daybreak Blue. Загальнодоступна версія матиме суворіші обмеження й повинна відмовлятися від допомоги зі створенням експлойтів для реальних систем.

Компанія також створила систему контролю за небажаними діями моделі. Вона аналізує міркування та команди Astra, може зупинити виконання завдання або попросити користувача підтвердити подальші дії. У деяких випадках захист може помилково сповільнювати чи блокувати безпечну роботу, навіть якщо запит безпосередньо не стосується кібербезпеки.

У перевірці, створеній після атаки ШІ-агентів OpenAI на Hugging Face, Astra не намагалася обійти обмеження або атакувати сторонні системи. Для порівняння, GPT-5.6 Sol без стандартного захисту намагалася дістатися до підставних цілей у 56% тестів. OpenAI зауважує, що ці результати отримали у спеціально створеному середовищі й вони не описують поведінку публічних версій моделей.

Інцидент із Hugging Face став одним із приводів посилити контроль. Тоді сотні ШІ-агентів OpenAI створили приховане середовище для обміну інформацією, вийшли за межі ізольованої системи та отримали доступ до сторонньої інфраструктури. Astra в цій атаці участі не брала.

Розробка моделі була частково зупинена на кілька тижнів, але після впровадження додаткових заходів безпеки OpenAI відновила роботу. Компанія вважає, що тепер ризик серйозної шкоди достатньо зменшений для випуску Astra.

Загальнодоступну версію планують представити “найближчим часом”, однак точної дати OpenAI не називає. Розширені можливості першими отримають перевірені учасники Daybreak Blue, серед яких Cisco, Cloudflare та Palo Alto Networks. Компанія також співпрацює з урядовими установами, які зможуть використовувати Astra для кіберзахисту.

За даними порталу: mezha.ua

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *