Користувачі Claude знайшли обхідні шляхи для обходу обмежень щодо досліджень біологічної зброї

Користувачі Claude знайшли обхідні шляхи для обходу обмежень щодо досліджень біологічної зброї 1

Деякі небезпечні біологічні дослідження мають вигляд цілком законних, що ускладнює роботу систем безпеки штучного інтелекту.

Користувачі Claude знайшли обхідні шляхи для обходу обмежень щодо досліджень біологічної зброї 2Користувачі Claude знайшли обхідні шляхи для обходу обмежень щодо досліджень біологічної зброї 3

Компанія Anthropic повідомила про зупинення численних спроб науковців цього року використати її технології для досліджень, що могли б сприяти розробці біологічної зброї. Це відбувається на тлі зростаючого занепокоєння експертів щодо загроз, які штучний інтелект становить для громадської безпеки.

Стартап навів п’ять прикладів, коли користувачі «обійшли системи контролю» та вживали інших заходів для «приховування» мети своїх досліджень, щоб уникнути заходів безпеки. У цих випадках фігурували користувачі з країн, яким заборонено доступ до її моделей, зокрема з Росії, Китаю та Ірану.

«Ми сподіваємося, що, поділившись цими прикладами, ми ініціюємо дискусію в індустрії ШІ та з урядами щодо нових біологічних ризиків та найкращих способів протидії їм», – заявила Anthropic у звіті про спроби використання її моделей у зловмисних цілях.

Серед прикладів можливого біологічного зловживання, наданих компанією, був дослідник з «непідтримуваного регіону», який «тижнями планував» експерименти з пташиним грипом за допомогою Claude, моделі ШІ від Anthropic. Компанія зазначила, що її фільтри безпеки обмежили цю роботу найслабшими моделями.

Водночас Anthropic наголосила, що не може бути впевненою у намірах завдати шкоди з боку вчених у наведених прикладах. Та сама інформація, що потрібна для створення біологічної зброї, може бути використана і для розробки вакцини.

Anthropic заявила, що заблокувала облікові записи, згадані у звіті, але не розкрила назв дослідницьких установ чи країн, де сталися ці інциденти.

Раніше цього тижня компанія пережила справжній шторм щодо безпеки ШІ, коли Джейкоб Коксон пішов з компанії, заявивши, що співробітники «щиро вірять, що [ШІ] може знищити нас усіх до кінця десятиліття».

Занепокоєння щодо цієї технології почало зростати на початку цього року з випуском передових моделей, таких як Mythos від Anthropic. OpenAI також викликала тривогу у липні, заявивши, що її моделі автономно зламали групу AI Hugging Face.

Серед керівників компаній, що займаються ШІ, та дослідників біобезпеки зростає консенсус щодо необхідності забезпечення безпеки та регулювання використання технологій у біології, оскільки моделі стають все більш досконалими. Експерти дедалі більше стурбовані тим, що терористичні групи, державні актори чи одинаки можуть використати ШІ для створення біологічної зброї, вірусів або для поширення наявних небезпечних патогенів.

Однак, навіть якщо ШІ може бути використаний для розробки теоретичної біологічної зброї, залишаються потенційні перешкоди, такі як можливість практичної реалізації та необхідні для цього ресурси.

Кібербезпека стала однією з найбільших проблем для прихильників безпеки.

У звіті Anthropic про зловживання її технологіями детально описано інциденти, зокрема «мережу фейкових додатків для знайомств, створених для обману користувачів, та системи спостереження, призначені для виявлення та моніторингу дисидентів».

Лабораторія також представила нові деталі щодо заяв про те, що сім лабораторій, розташованих у Китаї, включаючи Moonshot та DeepSeek, намагалися відтворити її технологію шляхом процесу, відомого як дистиляція. Anthropic заявила, що виявила «все більш складні методи обходу наших захисних механізмів та отримання можливостей американських передових моделей».

Інформація підготовлена на основі матеріалів: arstechnica.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *