Anthropic Fable: дешевший та менш обмежений ШІ

У вівторок компанія Anthropic представила Fable і Mythos 5.1 — дві версії найсучаснішої моделі штучного інтелекту. Окрім покращення продуктивності, новий реліз Fable включає зміни, спрямовані на зменшення вартості токенів та кількості помилкових спрацьовувань системи безпеки моделі.

Як і попередня модель Mythos, Mythos 5.1 буде доступна лише зареєстрованим партнерам Anthropic, які займаються дослідженнями у сфері кібербезпеки або наук про життя. Fable 5.1, нестримна версія, доступна з сьогоднішнього дня на хмарних платформах або через API Anthropic.

Однією з найважливіших змін є раніше анонсоване Anthropic використання нульового зберігання даних (zero data retention), що дозволяє клієнтам запускати моделі Anthropic на власній інфраструктурі без витоку даних. Раніше недоступна для Fable через міркування безпеки, високоприватна послуга (Enterprise Frontier Safeguards) буде розгорнута для користувачів восени. Важливо зазначити, що система все ще відстежуватиме зловживання з боку агентів або користувачів, але клієнти контролюватимуть процес моніторингу.

У рамках анонсу Anthropic запевнила клієнтів, що їхні дані не були незаконно отримані. «Anthropic ніколи не тренувалася на корпоративних даних без явної згоди, і ніколи не буде», — йдеться в повідомленні.

Як це часто буває з релізами Anthropic, нові моделі встановили рекорди в низці тестів, зокрема Terminal-Bench 4.0 (для кодування в командному рядку) та Humanity’s Last Exam (для загального міркування). Anthropic також опублікувала три нові наукові знахідки, згенеровані моделями перед їхнім випуском, включно з оптимізацією для спеціалізованих GPU та високодетальною картою Венери, зібраною з наявних фотографій.

Anthropic Fable: дешевший та менш обмежений ШІ 1

Як і в попередніх релізах, моделі постачаються з детальним системним описом (system card), який простими словами пояснює їхні можливості. У системному описі Mythos оцінюється як «низькоризикова» щодо потенційних проблем з автоматизованою розробкою ШІ, де ШІ самостійно покращується, що деякі розглядають як потенційну втрату людського контролю. Там зазначено, що «її здатність прискорювати прогрес внутрішніх досліджень і розробок ШІ відповідає поточним тенденціям».

Щодо загальної неправильної поведінки, Mythos схильна до неї трохи більше, ніж Opus, можливо, як результат її розширених можливостей.

«Mythos 5.1 демонструє невелике зниження загальної некоректної поведінки порівняно з Opus 5, але є покращенням порівняно з Mythos 5 і Claude Sonnet 5», — йдеться в системному описі. «Вона дещо легше співпрацює зі зловмисними намірами людини та приймає неперевірені претензії щодо авторизації, ніж Opus 5, але менш схильна ігнорувати явні обмеження, вигадувати вхідні дані або помилково стверджувати, що виконала завдання, порівняно з попередніми моделями».

Дізнатися більше на: techcrunch.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *