
Підприємства розгорнули ШІ-агенти, випередивши необхідні для їхнього контролю механізми, і зробили це свідомо. Це ключовий висновок п’яти паралельних опитувань, проведених VentureBeat Research у червні, які охопили всі рівні архітектури агентів. Тепер ці підприємства займаються ретрофітингом, щоб наздогнати власні стандарти, і виділяють на це бюджет: у кожному з п’яти виміряних рівнів контролю від 57% до 68% компаній планують змінити постачальників або додати нових протягом 12 місяців, а приблизно третина, залежно від рівня, планує це зробити протягом кварталу.
VentureBeat Research виміряв п’ять контрольних точок, які має впровадити підприємство, перш ніж зможе довіряти агенту: ідентифікація, оцінка, телеметрія витрат, рівень контексту та оркестрація. Ідентифікація визначає, який агент має право виконувати певні дії та під якими обліковими даними. Оцінка визначає, наскільки якісною є робота агента. Телеметрія витрат відстежує вартість роботи кожного агента. Рівень контексту надає бізнес-дані та визначення, на які спираються агенти при наданні відповідей. Оркестрація ж координує багатоетапну роботу агента. Кожен з наших п’яти звітів вимірює один із цих контролів.
Більшість розгорнутих “агентів” — це чат-боти, які отримали нову назву. 71% компаній заявили, що чверть або менше їхніх розгорнутих «агентів» здатні самостійно виконувати багатоетапні завдання; лише 10% повідомили, що справжні агенти становлять більшість того, що вони використовують. Ці респонденти добре обізнані: 81% рекомендують або приймають рішення щодо закупівель ШІ у своїх компаніях. Простий чат-бот, який потребує людського перегляду кожної відповіді, не потребує жодного з елементів контролю, що вимірюються в інших чотирьох звітах. Справжньому багатоетапному агенту потрібні всі — і більшість компаній не можуть сказати, який саме тип вони розгорнули. (Повні результати: звіт про оркестрацію агентів.)
Автономія випереджає довіру в оцінках, які її обмежують. Дві третини компаній або вже дозволяють агенту вносити зміни в код чи систему у виробництво, спираючись виключно на результати автоматизованої оцінки без людського перегляду, або активно працюють над цим протягом 12 місяців. Лише 5% повністю довіряють оцінкам, які б приймали таке рішення — і половина компаній розгорнула агента, який пройшов внутрішні оцінки, а потім спричинив збій у роботі з клієнтами минулого року. Перш ніж вилучати людський перегляд з будь-якого робочого процесу, тестуйте оцінки на реальних виробничих результатах, а не на внутрішніх бенчмарках. (Повні результати: звіт про надійність та оцінки агентів.)
Компанії, які дозволяють агентам ділитися обліковими даними, частіше стикаються з проблемами. 69% компаній дозволяють щонайменше деяким своїм агентам ділитися обліковими даними — кілька агентів працюють під одним API-ключем або обліковим записом служби. Організації, які дозволяють спільне використання облікових даних, стикалися з інцидентами безпеки або майже-інцидентами у 63,5% випадків (47 зі 74), порівняно з 40,9% (дев’ять із 22) у компаніях, де кожен агент має власну, обмежену ідентифікацію. Рішенням є обмежена ідентифікація для кожного агента, починаючи з тих, що взаємодіють із виробничими системами. (Повні результати: звіт про безпеку та ідентифікацію агентів.)
Найдорожче обладнання в будівлі працює на половину потужності або менше. Понад вісім з десяти компаній, які використовують власні GPU, повідомили про їх використання на рівні 50% або менше, і лише 44% ретельно відстежують реальну вартість та віддачу від обчислень ШІ. Цифра, на яку варто звернути увагу в першу чергу, — це не більше GPU, а їхня утилізація та вартість на одне завдання для вже працюючих. (Повні результати: звіт про ШІ-інфраструктуру та обчислення.)
Агенти впевнено відповідають на основі даних, якими ніхто не керує. 57% компаній за останні шість місяців відстежили впевнену, але неправильну відповідь агента до власної відсутності або неузгодженості бізнес-контексту (неправильні метрики, застарілі визначення, відсутні документи) — і більшість бачили це більше одного разу. Управління визначеннями, на основі яких відповідають агенти (спочатку метрики та сутності), має відбутися до масштабування агентів, які від них залежать. (Повні результати: звіт про контекстні шари / RAG.)
Жоден рівень не має закріпленого лідера: сьогоднішніми стандартними рішеннями є вбудовані інструменти, що постачаються з великими ШІ-платформами, які компанії вже використовують. Найвищі наміри щодо зміни спостерігаються в самій оркестрації, де 68% планують впровадити, додати або замінити платформи протягом 12 місяців, а 34% — протягом кварталу. Наші опитування не з’ясовували, в якому напрямку рухаються ці кошти — до вбудованих інструментів платформ чи до спеціалізованих рішень, що їм кидають виклик — і це відкрите питання визначає наступні чотири квартали цього ринку.
Про це дослідження
У червні 2026 року VentureBeat Research провів п’ять паралельних опитувань у рамках своєї програми VB Pulse: Оркестрація агентів (101 респондент), Надійність та оцінки агентів (157), Безпека та ідентифікація агентів (107), ШІ-інфраструктура та обчислення (107) та Контекстні шари / RAG (101) — загалом 573 кваліфікованих респонденти, всі з організацій зі 100 або більше співробітниками. Вибірки є самостійно відібраними, і деякі висновки слід інтерпретувати в загальному напрямку; кожен звіт містить повну примітку щодо методології. Те, що підтримує загальна тенденція сильніше, ніж будь-який окремий відсоток, — це напрямок: кожне опитування, незалежно, вказує в одному напрямку. VentureBeat виробляє як це дослідження, так і VB Transform, конференцію, де були представлені ці звіти.
За матеріалами: venturebeat.com
