Нестримний розвиток небезпечних ШІ-моделей неминучий

Здатні до злому моделі ШІ незабаром стануть нормою.

Нестримний розвиток небезпечних ШІ-моделей неминучий 1
Даріо Амодеї на сцені Code with Claude 2026 у Сан-Франциско. Автор: Samuel Axon
Нестримний розвиток небезпечних ШІ-моделей неминучий 2
Даріо Амодеї на сцені Code with Claude 2026 у Сан-Франциско. Автор: Samuel Axon

Минулого тижня компанія Anthropic припинила роботу своїх нових моделей ШІ Claude Fable 5 та Mythos 5 після директиви уряду США щодо контролю за експортом, яка забороняла «будь-яким іноземним громадянам» користуватися цими послугами. Компанія веде переговори з Білим домом із п’ятниці, але ще не досягла угоди, яка дозволила б відновити пропозицію.

Відколи Mythos дебютувала у квітні, Anthropic стверджувала (і попереджала), що модель має розширені можливості не лише для пошуку вразливостей програмного забезпечення, щоб допомогти захисникам їх виправляти, але й для пошуку способів їх експлуатації, які могли б використовуватися зловмисниками. Сама Anthropic зазначила цей подвійний ефект у своєму запуску Mythos 5 та Claude Fable 5. «Значна частина передових застосувань моделей ШІ є подвійного призначення: ті самі запити, які є корисними в руках фахівців з кібербезпеки та дослідників біології, можуть бути небезпечними, якщо вони доступні зловмисникам», — написала компанія у блозі минулого тижня.

Зважаючи на це, компанія спочатку випустила версію під назвою Mythos Preview для обраного консорціуму як частину робочої групи, відомої як Project Glasswing. Mythos 5 також була приватно випущена цій групі минулого тижня, тоді як Claude Fable 5, яка є моделлю класу Mythos, була випущена для широкої публіки з певними обмеженнями щодо її здатності надавати відповіді на запитання про біологію та кібербезпеку.

Потім, наприкінці минулого тижня, адміністрація Трампа вжила заходів для обмеження обох моделей, оскільки вважає, що захисні механізми Fable 5 можуть бути вимкнені, щоб надати повний доступ до можливостей Mythos 5, що, як стверджується, робить її ризиком для національної безпеки.

Однак експерти кажуть, що цей інституційний конфлікт лише затримує або маскує сувору правду: Anthropic може бути вістрям списа в цей момент, але можливості ШІ загалом і моделі від кількох компаній та розробників з відкритим кодом майже напевно матимуть подібні можливості до Mythos 5 у найближчому майбутньому — якщо вони вже не мають їх.

«Надзвичайно короткозоро думати, що жоден інший конкурент Anthropic не розробить подібні можливості до Mythos, або навіть що вони ще цього не зробили», — говорить Тара Вілер, головний співробітник з безпеки спеціалізованої консалтингової компанії з кібербезпеки TPO Group. «Є інші компанії, які йдуть за Anthropic, які, ймовірно, також мають ці можливості і тримають їх про запас, спостерігаючи, як ставляться до Anthropic у поточному регуляторному середовищі».

Сама Anthropic наголошувала на цьому пункті з моменту запуску Mythos Preview. «Справжнє повідомлення полягає в тому, що це не стосується моделі чи Anthropic», — сказав Logan Graham, керівник команди червоного команди з перспективних розробок компанії, WIRED, коли Mythos Preview була запущена у квітні. «Нам потрібно готуватися зараз до світу, де ці можливості будуть широко доступні через 6, 12, 24 місяці».

OpenAI, наприклад, також здійснила приватний випуск моделі, орієнтованої на кібербезпеку, у середині квітня та оголосила про розширену стратегію кібербезпеки.

Дослідники зазначають, що навіть до цього наступного покоління моделей, існуючі пропозиції ШІ могли б використовуватися для розширеного пошуку вразливостей та розробки експлойтів за допомогою вдосконаленого механізму. Велика група лідерів з кібербезпеки наголосила на цьому адміністрації у відкритому листі в неділю, стверджуючи, що директива Білого дому щодо контролю за експортом була помилковою.

«Це не одна модель; це загальна тенденція технології», — каже Брюс Шнайєр, дослідник Гарвардського університету та Університету Торонто, який аналізує ситуацію. «Менші, дешевші, моделі з відкритим вихідним кодом, іноді самі по собі, а іноді у поєднанні один з одним, можуть відповідати продуктивності Mythos/Fable за допомогою більш складного промптингу. І ми повинні очікувати, що інші моделі відповідатимуть креативності та наполегливості Mythos/Fable протягом місяців — трохи довше для моделей з відкритим вихідним кодом».

На думку експертів, Білий дім і уряди по всьому світу повинні зосередитися на демократичній розробці набагато ширших та прозоріших планів щодо того, як вони будуть боротися з досягненнями можливостей ШІ в галузі кібербезпеки та в інших чутливих сферах, коли вони неминуче відбуватимуться.

«Політичне питання полягає не в тому, чи має технологія ризик», — каже Кріс Висопал, співзасновник хмарної компанії з безпеки Veracode. «Питання в тому, чи конкретне обмеження суттєво знижує цей ризик, чи воно в основному сповільнює тих, хто намагається зробити системи безпечнішими».

За матеріалами: arstechnica.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *