Регулятори оцінюють вразливості Patch Tuesday за допомогою ШІ, але рідко діляться деталями з клієнтами

Регулятори оцінюють вразливості Patch Tuesday за допомогою ШІ, але рідко діляться деталями з клієнтами 1

Кріс Ґеттл місяцями тренував навичку Claude на тих самих даних про виправлення, які він вручну обробляв десятиліття. Вона постійно вигадувала деталі.

«Ви бачите щось явно неправильне, і врешті-решт вам набридає, і ви питаєте: «Ти це просто вигадав?», — розповів Ґеттл VentureBeat. — «І вона буквально відповідає, що не має жодних фактичних підстав чи матеріалів для посилання. Усе це було я».

Ґеттл є віцепрезидентом з управління продуктами безпеки кінцевих точок в Ivanti. Навичка, яку він розробив, застосовує власну пріоритезацію ризиків загроз Ivanti до необроблених даних виправлень, працює на платформі Anthropic, використовує лише опубліковані рекомендації постачальників та власні електронні таблиці Ivanti, і не торкається даних клієнтів. Кожен результат є чернеткою, доки людина не схвалить його для публікації. Щонайпріоритезований брифінг Patch Tuesday щомісяця охоплює від 500 до 700 відвідувачів вебінарів.

Штучний інтелект вигадує дані в конвеєрах, які створюють рекомендації з безпеки, на основі яких діють корпоративні клієнти. Найбільші постачальники послуг безпеки тепер використовують ШІ для ранжування CVEs Patch Tuesday, але їхні клієнти не знають, що саме призвело до такого ранжування. Ivanti — єдиний постачальник, якого VentureBeat знайшов, що описав вигадки власної навички ШІ та етап перевірки, створений для їх виявлення.

Сім підрахунків, розбіжність у 205 CVEs

8 вересня Microsoft випустила найбільше оновлення Patch Tuesday в своїй історії. Сім трекерів опублікували загальну кількість виправлень за той самий вівторок. Tenable нарахував 964 CVEs. Senserva, який рахує CVEs на основі KB-статей, а не рекомендацій, дійшов до 1 169. Це розбіжність у 205 CVEs для одного й того ж набору виправлень. Дві з цих вразливостей були нульового дня, які вже використовувалися в мережі до випуску виправлення. Найбільший Patch Tuesday до 2026 року, згідно з червневою публікацією Ivanti, містив 175 CVEs у жовтні 2025 року. Сама лише вереснева розбіжність перевищує попередній рекорд.

Регулятори оцінюють вразливості Patch Tuesday за допомогою ШІ, але рідко діляться деталями з клієнтами 2

Не кожну розбіжність вимагає пояснювати ШІ. Визначення обсягу та методи підрахунку самі по собі призводять до широкого розкиду. ШІ змінює рівень між необробленими даними та рівнем ризику, на основі якого діє клієнт. Microsoft припинила надавати єдиний щомісячний список CVEs у своєму Security Update Guide, починаючи з Patch Tuesday у липні. Адам Барнетт з Rapid7 задокументував цю зміну 14 липня. Дастін Чайлдс з Zero Day Initiative, чий незалежний реєстр сягає двох десятиліть, розпочав свій липневий огляд, заявивши: «Апокаліпсис багів повністю спустився на нас». Кожен постачальник тепер створює власний список.

Всередині навички, яка створила 973

Ґеттл детально розповів VentureBeat про цю навичку під час нещодавнього інтерв’ю.

Він тренував систему по постачальниках. Спочатку Microsoft, оскільки їхні завантажувані електронні таблиці зробили це тренування найчистішим. Adobe був складнішим. Adobe не надає чисту електронну таблицю, тому Ґеттл вказав URLs окремих сторінок і навчив систему читати структуру сайту Adobe. Він налаштував навичку так, щоб вона позначала відхилення від типового шаблону випусків кожного постачальника, тому відомі експлойти, публічні розкриття інформації та незвичайні обсяги CVEs — усе це запускає ескалацію рівня ризику, на яку покладаються його клієнти.

Розклад випусків Adobe неодноразово повертався неправильним. Потрібне було уточнення для редакцій Office, оскільки Microsoft ділить Office на кілька сімейств редакцій, і навичка їх плутала. Шаблон зберігається навіть у робочому режимі. Саме через вигадки існує етап перевірки. Ґеттл побудував людський фільтр навколо режимів збоїв, які він виявив під час тренування.

Ґеттл та Тодд Шелл, старший менеджер з продуктів Ivanti, відповідальний за виправлення, витрачали приблизно 48 годин щомісяця перед кожним Patch Tuesday на дослідження постачальників та підготовку пріоритетного брифінгу, який отримують їхні клієнти. Ці зусилля займали щонайменше 5% їхнього спільного робочого часу щомісяця.

Шелл повторно запустив навичку на даних, зібраних вручну за два попередні місяці. Ivanti стверджує, що їхні рецензенти виявили 98% відповідності, з кількома крайніми випадками для виправлення. VentureBeat не проводив незалежний аудит набору даних, методу оцінки чи категорій помилок. Серпневий запуск був першим місяцем експлуатації. Ґеттл був у відпустці. Електронна таблиця, яка раніше займала близько чотирьох годин для двох людей, була оброблена менш ніж за 30 хвилин. 8 вересня, з 973 CVEs за підрахунками Ivanti, це був другий місяць експлуатації навички.

Регулятори оцінюють вразливості Patch Tuesday за допомогою ШІ, але рідко діляться деталями з клієнтами 3

Решта ланцюга рекомендацій

CrowdStrike та Palo Alto Networks також зберігають людей у ланцюгу. На Fal.Con 2026 CrowdStrike описав дизайн «людина в циклі», де аналітик паралельно з агентом обробляє те саме виявлення, порівнюючи вироки на тих самих даних одночасно. Palo Alto випустив Cortex XSIAM AgentiX у лютому 2026 року з попередньо створеними агентами, що потребують схвалення людини в циклі для дій з високим впливом. Усі три постачальники незалежно один від одного дійшли до такої конструкції. Ні CrowdStrike, ні Palo Alto публічно не розкривали виявлення вигадок.

Незалежна оцінка

Кейн МакГладрі, старший член IEEE, незалежний vCISO та автор книги «Кіберризик – це міф», не має зв’язків з Ivanti і письмово відповів про практику, а не про конкретного постачальника.

«Постачальник зобов’язаний надати своїм клієнтам одну сторінку в письмовій формі, перш ніж перше пріоритетне завдання потрапить до чиєїсь черги», — написав МакГладрі в електронному листі VentureBeat. — «Ця сторінка повинна охоплювати, де модель знаходиться в конвеєрі, чи парсить CVEs детермінований код, чи LLM виконує підрахунок, хто перевіряв вихідні дані, і яка частка зі списку з 400 рядків була перевірена за джерелом, а не просто переглянута».

На запитання, чи достатньо повторного запуску, а потім перечитування людиною перед випуском, він відповів: ні.

«Повторний запуск перевіряє, чи схожий цей місяць на попередній. Він нічого не говорить про правильність. Людина, яка читає, може не досягти значно кращого результату, тому що важливим збоєм є CVE, який ніколи не з’являється, і ніхто, хто переглядає список, згенерований машиною, не помітить, що чогось бракує».

Шелл порівнював вихідні дані навички з даними, які він і Ґеттл збирали вручну за місяці, а не з формою попереднього місяця. Це порівняння не вирішує другого пункту МакГладрі. Рівні ризику не перевірялися незалежно, а рядок, який ніколи не з’являється, залишається невидимим для рецензента, який читає рядки, що є.

Що відвантажується, а що залишається

Трекер VentureBeat Pulse «Надійність агентів та оцінки» за липень 2026 року опитав 108 підприємств у своїй дослідницькій панелі. 49% відправили агент, який пройшов внутрішні оцінки, а потім зазнав невдачі перед клієнтом. 37% дозволили автономному агенту розгортати зміни без участі людини. 13% повністю довіряють автоматизованій оцінці. Серед 53 підприємств, постраждалих від збою оцінки, лише 4% досі йому довіряють.

Регулятори оцінюють вразливості Patch Tuesday за допомогою ШІ, але рідко діляться деталями з клієнтами 4

Команда Ґеттла зберегла людського рецензента. CrowdStrike зберіг паралельного аналітика. Palo Alto зберіг шлюз схвалення.

Тиск, що стимулює впровадження, реальний. Обов’язкова операційна директива CISA № 26-04 від червня 2026 року встановила триденний термін для усунення найризикованіших вразливостей у федеральних цивільних агентствах. У звіті CrowdStrike про виявлення загроз за 2026 рік виявлено, що 88% зафіксованих експлуатацій з загальнодоступним доказом концепції почалися протягом 48 годин.

Розкриття інформації, про яке ніхто не повідомив

9 червня Ivanti опублікував допис Patch Tuesday з підписом «Графіка згенерована за допомогою Claude (Anthropic) 9 червня 2026 року на основі запитів, розроблених автором, та набору даних від Кріса Ґеттла». Жодне положення чи галузевий стандарт не вимагали цього розкриття, і цей підпис залишався на сайті Ivanti протягом трьох місяців.

Computer Weekly, Cyber Magazine, Help Net Security, Krebs on Security та Rapid7 цього року публікували цифри Ґеттла. Жодне з цих видань не повідомило, що рекомендації частково створені навичкою, що помилково робила навичка під час тренування, або про ланцюг перевірки між нею та випуском.

Три запитання до будь-якого постачальника, що надає рекомендації за допомогою ШІ

Ґеттл вважає, що сам процес прийняття рішень є продуктом. «Найважливіше — це моя експертиза в предметній галузі», — сказав він VentureBeat. — «Знання того, що важливо, а що ні, здатність приймати обґрунтовані рішення, надавати рекомендації, керувати інструментами, щоб допомогти в цьому».

Стандарт МакГладрі на одну сторінку дає команді з виправлень мову для притягнення будь-якого постачальника до відповідальності. Будь-який керівник SOC, який отримує рекомендації Patch Tuesday, може поставити три запитання сьогодні й отримати відповідь до 13 жовтня:

  • Яка частина ваших рекомендацій Patch Tuesday згенерована ШІ?

  • Проти чого вона була перевірена, і чи перевірка виявляє відсутній рядок?

  • Хто її переглядає перед випуском, і чи це розголошується?

13 жовтня — наступний Patch Tuesday. Парсинг почнеться знову, і загальна кількість залежатиме від того, що кожен постачальник вирішить врахувати.

За матеріалами: venturebeat.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *