Моделі ШІ з розширеними можливостями злому незабаром стануть нормою.

Минулого тижня компанія Anthropic вилучила свої нові моделі ШІ Claude Fable 5 та Mythos 5 з доступу після розпорядження уряду США про експортний контроль, яке забороняє “будь-яким іноземним громадянам” користуватися цими послугами. Компанія веде переговори з Білим домом з п’ятниці, але ще не досягла угоди, яка дозволила б відновити доступ до продуктів.
З моменту запуску Mythos у квітні Anthropic стверджувала (і попереджала), що ця модель має розширені можливості не тільки для пошуку вразливостей програмного забезпечення, щоб допомогти захисникам їх усунути, але й для пошуку способів їх експлуатації, які могли б використати зловмисники. Сама Anthropic зазначила цю двосічну природу в анонсі Mythos 5 та Claude Fable 5. “Значна частина розширеного використання моделей ШІ є подвійного призначення: ті самі запити, які корисні в руках фахівців з кібербезпеки та дослідників біології, можуть бути небезпечними, якщо доступні зловмисникам”, – написала компанія у блозі минулого тижня.
З огляду на це, компанія спочатку випустила версію під назвою Mythos Preview для вибраного консорціуму як частину робочої групи, відомої як Project Glasswing. Mythos 5 також був приватно випущений цій групі минулого тижня, тоді як Claude Fable 5, модель рівня Mythos, був випущений для широкої громадськості зі спеціальними блокуваннями можливості надавати відповіді на запитання про біологію та кібербезпеку.
Потім, наприкінці минулого тижня, адміністрація Трампа вжила заходів для обмеження доступу до обох моделей, оскільки вважає, що захисні механізми Fable 5 можуть бути вимкнені, що дозволить повний доступ до функцій Mythos 5, що потенційно робить її ризиком для національної безпеки.
Однак експерти зазначають, що цей конфлікт просто відтерміновує або приховує сувору правду: Anthropic може бути передовою силою в даний момент, але можливості ШІ загалом, і моделі від багатьох компаній та розробників з відкритим кодом, майже напевно матимуть подібні можливості до Mythos 5 у найближчому майбутньому — якщо вони вже не мають.
«Було б надзвичайно короткозоро думати, що жодні інші конкуренти Anthropic не розроблять можливості, подібні до Mythos, або що вони ще не зробили цього», — каже Тара Вілер, головний директор з безпеки спеціалізованої консалтингової компанії з кібербезпеки TPO Group. «Є інші компанії, які йдуть слідом за Anthropic, які, ймовірно, також мають ці можливості і тримають їх у запасі, спостерігаючи, як розглядається Anthropic у поточних регуляторних умовах».
Сама Anthropic наголошувала на цьому пункті з моменту запуску Mythos Preview. «Справжнє повідомлення полягає в тому, що це не стосується моделі чи Anthropic», — сказав WIRED Логан Грехем, керівник команди з дослідження передових технологій компанії, коли Mythos Preview був запущений у квітні. «Нам потрібно готуватися зараз до світу, де ці можливості будуть широко доступні за 6, 12, 24 місяці».
Наприклад, OpenAI також здійснила приватний випуск моделі, орієнтованої на кібербезпеку, у середині квітня та оголосила про розширену стратегію кібербезпеки.
Дослідники зазначають, що навіть до появи наступного покоління моделей, існуючі рішення ШІ могли б використовуватися для розширеного пошуку вразливостей та розробки експлойтів з доопрацьованим інтерфейсом. Велика група лідерів у галузі кібербезпеки наголосила на цьому адміністрації у відкритому листі в неділю, стверджуючи, що директива Білого дому щодо експортного контролю була помилковою.
«Це не одна модель; це загальна тенденція технологій», — каже Брюс Шнайєр, дослідник Гарвардського університету та Університету Торонто, який аналізує ситуацію. «Менші, дешевші моделі з відкритим вихідним кодом, іноді самі по собі, а іноді в поєднанні один з одним, можуть відповідати продуктивності Mythos/Fable за допомогою більш складного промптингу. І ми повинні очікувати, що інші моделі відповідатимуть креативності та наполегливості Mythos/Fable протягом кількох місяців — трохи довше для моделей з відкритим вихідним кодом».
На думку експертів, Білий дім та уряди в усьому світі повинні зосередитися на демократичній розробці набагато ширших та прозоріших планів щодо того, як вони будуть боротися з досягненнями в галузі ШІ в кібербезпеці та інших чутливих сферах, коли вони неминуче відбуватимуться.
«Політичне питання не в тому, чи має технологія ризик», — каже Кріс Висопал, співзасновник хмарної компанії безпеки Veracode. «Питання в тому, чи конкретне обмеження суттєво зменшує цей ризик, чи воно головним чином сповільнює тих, хто намагається зробити системи безпечнішими».
Оригінал статті: arstechnica.com
