Платіть за передові ШІ-моделі: 4 місяці переваги коштуватимуть уп’ятеро дорожче

Платіть за передові ШІ-моделі: 4 місяці переваги коштуватимуть уп'ятеро дорожче 1

Згідно зі звітом Mozilla, розрив у продуктивності між передовими моделями ШІ від американських технологічних компаній та найкращими відкритими моделями від китайських компаній скоротився до 4,4 місяців. Це пояснює, чому багато компаній переходять на значно дешевші відкриті моделі для рутинної роботи, і допомагає виявити вузький діапазон робочих навантажень, де передові моделі виправдовують свою вартість.

Більшість організацій, за даними останнього звіту State of Open Source AI від Mozilla, опублікованого 15 вересня, повинні за замовчуванням використовувати відкриті моделі для більшості своїх завдань. Звіт підкреслює, що провідна відкрита модель Moonshot AI Kimi K3 демонструє сукупний показник продуктивності ШІ на індексі Artificial Analysis Intelligence Index лише на три пункти відстаючи від закритої передової моделі Anthropic Fable 5, при цьому коштуючи лише 30 відсотків від останньої.

«Закрита модель виправдовує свою преміальну ціну в кількох сферах: експертна професійна робота, інтенсивний пошук інформації та довгий контекст», — зазначив Раффі Крікорян, технічний директор Mozilla, в електронному листі до Ars. «Ми розглядаємо рішення платити за закриті [моделі] як специфічне для робочого навантаження, а не для організації».

Відкриті моделі ШІ дозволяють будь-кому завантажувати основні компоненти моделі та запускати їх на власних комп’ютерах, але розробники, як правило, все ще приховують важливу інформацію, таку як навчальні дані, конвеєр даних та код для навчання. Натомість американські технологічні компанії, такі як Anthropic та OpenAI, переважно пропонують закриті передові моделі, які зберігають все як пропрієтарне, вимагаючи від клієнтів платити більше за доступ.

Організації все ще платять за закриті передові моделі, оскільки вони працюють «з коробки» і поставляються з «пакетами відповідності, підтримкою та підзвітністю», тоді як багато організацій не мають персоналу для ефективної роботи з відкритими моделями, пояснив Крікорян.

Однак, стабільно звужується розрив у продуктивності між відкритими та закритими передовими моделями, разом із економічною ефективністю відкритих моделей, зараз широко визнається багатьма компаніями. Наприклад, сервіс доставки DoorDash використовує Kimi для рутинної роботи, зберігаючи Fable для складніших завдань, які зазвичай потребують більше часу для виконання людськими експертами.

Не дивно, що це прискорило використання відкритих моделей відтоді, як 14 липня було опубліковано перший звіт Mozilla State of Open Source AI.

Вимірювання розриву в продуктивності

Звуження розриву в продуктивності вимірюється кількома способами. Наприклад, некомерційна дослідницька організація METR визначила часовий горизонт моделі ШІ як тривалість завдань — виміряну за часом, який потрібен людським експертам для їх завершення — які можуть бути виконані моделями ШІ з «надійною» 50-відсотковою успішністю. Цей часовий горизонт подвоюється за встановленою схемою, яка з часом прискорюється.

Найкраща закрита модель наразі може виконати завдання, яке триває в 1,7 раза довше, ніж найдовше завдання, яке найкраща відкрита модель може надійно завершити.

«Якщо відкритий фронт може впоратися з 7-годинним завданням, закритий фронт може впоратися з 12-годинним», — сказав Крікорян Ars. «Через чотири місяці відкрита модель впорається з 12-годинним завданням, а закрита — приблизно з 20».

Завдання, що вимагають від восьми до 12 годин, зазвичай є тими, з якими може впоратися закрита передова модель, а відкриті моделі поки що не можуть, сказав Крікорян. Жодні моделі, як правило, не здатні надійно виконувати завдання тривалістю понад 12 годин, тоді як завдання тривалістю менше восьми годин можуть виконуватися обома типами моделей і можуть бути передані на виконання дешевшим відкритим моделям.

Існує багато нюансів і застережень для таких порівнянь. Наприклад, закриті передові моделі часто постачаються з власним «харднесом» — програмним шаром, який допомагає моделям отримувати доступ до різних інструментів та пам’яті для виконання дій, подібних до дій агента. Харднеси, розроблені ШІ-лабораторіями для їхніх моделей, іноді можуть підвищити продуктивність у різних завданнях, тоді як моделі можуть працювати менш добре з сторонніми харднесами.

Щоб вирівняти поле для гри, компанія з бенчмаркінгу Vals AI оцінює різні відкриті та закриті моделі, використовуючи власний нейтральний харднес. Коли кожна модель працювала на одному харднесі в оцінці Terminal-Bench 2.1, відкрита модель GLM 5.2 від китайської компанії Z.ai (Zhipu AI) набрала один бал менше, ніж Claude Opus 4.7 і 4.8 від Anthropic, коштуючи приблизно вп’ятеро дешевше за виконане завдання.

Іншими словами, плата за закриті передові моделі забезпечує перевагу приблизно чотири місяці за приблизно п’яту частину вартості за завдання — але лише тоді, коли зараз розглядаються завдання тривалістю від восьми до 12 годин.

«Платіть, коли ця перевага того варта, наприклад, якщо крайній термін настане до того, як відкритий фронт наздожене», — сказав Крікорян Ars. «Рутинна робота, яку ви будете виконувати наступного кварталу, не є такою, оскільки незабаром ви зможете робити її за п’яту частину вартості, і модель не буде вузьким місцем у будь-якому разі».

Концентрація влади

Зростаюча популярність відкритих моделей спостерігається на OpenRouter, ШІ-шлюзі та ринку, який надає розробникам доступ до сотень різних моделей від багатьох постачальників. У звіті Mozilla зазначено, що вісім з топ-10 моделей за обсягом токенів у серпні 2026 року мають відкриті ваги.

Однак, відкриті моделі все ще відстають від закритих передових моделей за доходом. У статті Френка Нагла та Даніеля Ю для Linux Foundation зазначено, що відкриті моделі заробили лише 4 відсотки від загального доходу порівняно із закритими моделями, які отримують 96 відсотків доходу — хоча вони розглядали дані за період з травня по вересень 2025 року.

«За останній рік відкриті моделі вибухнули, тому ми очікуємо, що дохід перемістився», — сказав Крікорян.

«Наразі більшість відкритих моделей, на яких працює світ, є китайськими», — сказав Крікорян. «Китайські лабораторії використовують ту саму стратегію, яку використовували американці з Android — віддайте безкоштовно, але володійте екосистемою навколо нього», — пояснив він.

Але Крікоріан не стільки стурбований «китайськими моделями», скільки ризиком концентрації. На даний момент найкращі відкриті моделі зосереджені в Китаї, тоді як найкращі закриті передові моделі походять від американських компаній. Він виступав за те, щоб американські та європейські лабораторії почали конкурувати в «тому ж відкритому напрямку, щоб жодна країна не встановлювала глобальні стандарти».

«Незружна правда полягає в тому, що плюралістична екосистема навколо відкритих ШІ-моделей значною мірою фінансується китайським капіталом», — сказав Крікорян. «Це одночасно і множинність, і концентрація».

Історія розвитку відкритого програмного забезпечення, такого як Linux, може запропонувати деякі уроки щодо того, як може зібратися «альтернативна коаліція», сказав Крікорян. Таке програмне забезпечення з відкритим кодом фінансувалося коаліцією організацій, «які потребували існування базового шару», включаючи нейтральні фонди.

Будь-яка коаліція для створення більш відкритих ШІ-моделей, ймовірно, складатиметься з «інституцій з місією, а не з ринковою орієнтацією», на відміну від передових ШІ-лабораторій, сказав Крікорян. Він описав це так:

Нам потрібні програми державного обчислення, що фінансують повністю відкриті референтні моделі. Шведський національний обчислювальний центр Apertus є прикладом. Фонди повинні займати ту саму нейтральну позицію, яку вони займали щодо відкритих протоколів інтернету, розширену на моделі, харднеси та стандарти для агентів. Компанії, які виграють від стандартних моделей, повинні брати участь. А філантропія повинна покривати те, що не зможуть інші — особливо інфраструктуру оцінки та аудиту.

Крікорян також закликав альтернативну коаліцію піти ще далі, ніж відкриті моделі, прийнявши ширший підхід відкритого програмного забезпечення. «Важко повністю довіряти моделі прийняття рішень, якщо ви не можете сказати, як її навчали або проти чого її оцінювали», — сказав він.

Платіть за передові ШІ-моделі: 4 місяці переваги коштуватимуть уп'ятеро дорожче 2

Джеремі Сюй

Дізнатися більше на: arstechnica.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *