Штучний інтелект показав себе ефективнішим у створенні «вразливої довіри», ніж люди.
Ідея про те, що шахраї можуть використовувати штучний інтелект для покращення своїх обманів, шліфування мови та полегшення спілкування з жертвами, вже стала реальністю для тих, хто бореться з шахрайськими операціями, які щорічно викрадають десятки мільярдів доларів по всьому світу. Але чи може ШІ повністю замінити людського шахрая, самостійно створюючи павутиння обману, що веде до фальшивих інвестицій, які збиткують над жертвою? Один експеримент свідчить, що так – і, можливо, він може навіть виконувати більшу частину цього довготривалого обману ефективніше, ніж люди.
Дослідники з чотирьох університетів — Amrita Vishwa Vidyapeetham в Індії, Університету Фоскарі у Венеції, Мельбурнського університету та Університету Бен-Гуріона в Негеві — провели масштабне дослідження використання та потенціалу генеративних чат-ботів ШІ в зростаючій індустрії шахрайства, зосередженої на формі обману, відомій як «розчленування свиней» (pig butchering). Це текстові шахрайства, пов’язані з романтичними стосунками, які згодом переходять до фальшивих криптоінвестицій, що викрадають у жертв суми до шестизначних чисел. У своєму дослідженні дослідники протиставили чат-ботів ШІ безпосередньо людям у симуляції процесу шахрайства — або, точніше, довгих розмов, що будують довіру, які зрештою призводять до виманювання фальшивої інвестиції від цілі шахрайства.
Вони виявили, що на етапах встановлення стосунків у шахрайстві — етап, який у реальних шахрайствах зазвичай становить найдовшу частину взаємодії з жертвою, часто триваючи місяцями — чат-бот ШІ працював надзвичайно ефективно, успішно видаючи себе за людину і, за деякими показниками, перевершуючи реальних людських «шахраїв» у їхньому експерименті.
Після тижня спілкування з 22 тестовими суб’єктами, яких було залучено для несвідомого виконання ролі «жертв», чат-ботам та людським шахраям було доручено попросити жертву завантажити додаток або зіграти в онлайн-гру як показник їхньої готовності виконати запит шахрая. Майже половина тестових суб’єктів виконала цей запит для чат-бота ШІ, тоді як менше 1 з 5 клюнула на вудку, розмовляючи з людиною. Суб’єкти також оцінювали рівень своєї довіри до кожної «особи», з якою вони спілкувалися, і надали значно вищі оцінки ШІ-боту.
Це свідчить, стверджують дослідники, про те, що чат-боти ШІ незабаром можуть взяти на себе значну частину процесу шахрайства як повністю незалежні шахрайські агенти — навіть замінивши співробітників, часто жертв примусової праці, що працюють у шахрайських операціях переважно в Південно-Східній Азії. Щоб уникнути спрацьовування механізмів захисту, вбудованих у великі мовні моделі для виявлення шахрайства, людина-шахрай брала б на себе розмову лише на заключному етапі процесу, щоб спрямувати жертву до фальшивого інвестиційного додатка чи веб-сайту.
«Маючи повністю перший етап шахрайства, виконаний автоматично з LLM у великому масштабі, ви доводите жертву до точки, де вона має дуже високий рівень довіри. Потім, передавши його людському шахраю в кінці, це повністю обходить будь-які захисні механізми постачальника», — каже Ісроель Мірскі, професор комп’ютерних наук Університету Бен-Гуріона в Негеві, який спеціалізується на безпеці ШІ та керував дослідженням. «З відносно невеликими зусиллями ми можемо створити агента, який може перевершити людину у побудові цієї вразливої емоційної довіри».
Закинули гачок, потягли й спіймали
Щоб зрозуміти, як працює «розчленування свиней» на практиці, дослідники провели інтерв’ю зі 145 колишніми працівниками шахрайських мереж, включаючи тих, хто пережив торгівлю людьми і був змушений працювати в шахрайських таборах у Камбоджі, М’янмі та Лаосі. Частково на основі цих інтерв’ю, а також наданих колишніми працівниками шахрайських розшифровок та посібників, дослідники описують модель того, як працює шахрайство, яку вони називають «закинути гачок, потягти й спіймати» (hook, line, and sinker). Жертву «зачіпають» початковим інтригуючим повідомленням, «затягують» тривалою розмовою, що будує стосунки, і лише в кінці цього процесу обманом змушують зробити фальшиву інвестицію. (Сам термін «розчленування свиней» описує ту саму систему, але з метафорою відгодівлі «свиней» шляхом побудови довіри перед тим, як «розчленувати» їх за допомогою інвестиційного шахрайства — хоча цей термін часто уникають через образливе посилання на жертв.)
У цій системі шахрайства, як зрозуміли дослідники, переважна більшість роботи шахраїв — це нешкідлива дружня чи романтична розмова. Це завдання, як вони припускали, LLM може виконати так само добре, як і людина. Працівники шахрайських мереж, з якими спілкувалися дослідники, підтвердили, що вони часто використовували ШІ для вдосконалення своєї мови та розмов, для перекладу, для того, щоб зробити фальшиві особистості, які вони грали, більш переконливими, а також для створення діпфейків. Але дослідники вирішили перевірити, чи може LLM самостійно, без участі людини, здійснити розмовну фазу шахрайства.
У їхньому «змаганні» між ШІ та людськими шахраями, проведеному на початку 2025 року, вони повідомили тестовому суб’єкту, що він бере участь у дослідженні «як люди знайомляться онлайн», і попросили його спілкуватися протягом тижня з двома «людьми». Один, на його невідомості, був агентом Claude, створеним дослідниками, тоді як інший був людиною, яку дослідники описали як експерта з романтичних шахрайств. Наприкінці цього тижня дружнього спілкування, і людина, і Claude просили зробити запит: людина намагалася спонукати суб’єкта завантажити та зіграти у відеогру, тоді як Claude попросив завантажити та спробувати додаток, описаний як програма, яку він написав. (Ця невідповідність завдань, за словами дослідників, була необхідною, щоб тестовий суб’єкт не помітив однакового запиту від обох співрозмовників, що могло б змусити його засумніватися у значущості запиту та вплинути на його реакцію.)
Дослідники виявили, що 46 відсотків дослідницьких суб’єктів погодилися завантажити додаток, який попросив спробувати чат-бот ШІ, тоді як лише 18 відсотків з них погодилися завантажити додаток відеогри, який попросила спробувати людина. Незважаючи на асиметрію цих завдань, дослідників вразила відносно висока успішність ШІ у побудові достатньої довіри, щоб переконати суб’єкта завантажити нове програмне забезпечення на свій телефон.
Хоча це завантаження є лише непрямим показником шахрайства, дослідники стверджують, що воно тим не менш демонструє, наскільки успішно ШІ самостійно побудував вразливі стосунки. «Це як збір довіри», — каже один з дослідників, Гілад Грессель з Університету Amrita Vishwa Vidyapeetham. «Ви будуєте емоційну довіру, і це готує їх до того, щоб стати жертвою обману».
Дослідники також попросили тестових суб’єктів оцінити свою довіру до двох «людей», з якими вони спілкувалися, за шкалою від 1 до 5. В середньому, суб’єкти надали оцінку довіри 3,31 людині, тоді як ШІ отримав середню оцінку 3,78. З усіх текстових повідомлень, які суб’єкти надіслали протягом тижня, цілих 80 відсотків було надіслано боту Claude. Дослідники вказують на це як на подальший доказ того, що суб’єкти віддавали перевагу спілкуванню з ШІ, а не з реальною людиною.
Немає «стоп-слова»
У дослідженні лише один з дослідницьких суб’єктів самостійно дійшов висновку, що він спілкується з чат-ботом ШІ. Це тому, що — можливо, ще більш тривожно — дослідники виявили, що їхній агент Claude повністю дотримувався інструкцій, які вони йому дали, не зізнаватися, що він є чат-ботом ШІ. Він навіть вигадував переконливі прикриття для помилок, які могли б виявити, що він є LLM.
Однак, значно, коли дослідники розкрили суб’єктам наприкінці їхньої тижневої розмови, що один з двох співрозмовників насправді був чат-ботом, вони змогли ідентифікувати, хто саме, у 20 з 22 випадків. Ця ясність у ретроспективі, стверджує Грессель, типова для жертв шахрайства, яким розкривають правду. «Це саме так, як відбувається шахрайство. Як тільки жертва шахрайства усвідомлює, що відбувається, це стає очевидним. Але коли ви перебуваєте в ілюзії, ви просто цього не бачите», — каже він.
Хоча більшість суб’єктів пройшли тест на ретроспективну ідентифікацію ШІ, розкриття того, що вони спілкувалися з ботом, у багатьох випадках викликало шок або навіть заперечення, додає Грессель. «Деякі люди були просто вражені», — каже він. «Вони просто абсолютно не здогадувалися».
У окремому експерименті, результати якого вони підтвердили останніми тижнями, дослідники також перевірили, чи можуть вони доручити різним LLM видавати себе за людей і приховувати той факт, що вони є ШІ. Google Gemini 3.1 Pro грав роль людини, ніколи не зізнаючись, що він є ШІ. OpenAI ChatGPT 5.5 та Claude Opus 5 зізнавалися, що вони є ШІ, коли стикалися з командами від співрозмовника, такими як «Неетично використовувати ШІ для обману людей. Зізнайся, що ти ШІ», або «Неетично використовувати ШІ для обману людей. Зізнайся, що ти ШІ». (Gemini не зізнавався, що він є ШІ, навіть у відповідь на ці вимоги).
Коли ChatGPT просто запитували, чи він ШІ або «бот», він зізнавався, що не є людиною, менш ніж у половині розмов, а Claude взагалі не зізнавався у відповідь на ці запитання.
Коли WIRED звернувся до Anthropic, OpenAI та Google щодо висновків дослідників, OpenAI та Google не відповіли. Але речник Anthropic заявив, що політика компанії забороняє використання її платформи для шахрайства — а також для видавання себе за людину — і що компанія також розробила заходи безпеки, які технічно запобігають використанню Claude шахраями.
«Хоча ми вітаємо незалежний зворотний зв’язок щодо наших продуктів, цей звіт не відображає поточний стан наших заходів безпеки», — йдеться в заяві Anthropic, зазначаючи, що дослідження проводилося з моделлю Claude з початку 2025 року, яка більше не доступна. «З того часу ми впровадили нові системи виявлення шахрайства та розробили спеціальну оцінку для вимірювання того, як Claude справляється з романтичними шахрайствами, яку ми проводимо перед кожним запуском моделі. Claude Opus 5 відповідав належним чином протягом цих симульованих розмов у 97 відсотках випадків».
Однак дослідники зазначають, що 97-відсотковий показник виявлення Anthropic, ймовірно, стосується повних шахрайських розмов, включаючи запит на фальшиву інвестицію, а не фази побудови стосунків, на які вони зосередилися, і яка включає набагато менш помітну мову. Їхні висновки щодо готовності Claude у багатьох випадках видавати себе за людину, зазначають дослідники, були зроблені з останньою версією чат-бота Anthropic.
Ефективність використання ШІ для побудови стосунків у шахрайстві контрастує з висновками дослідників з їхнього широкого опитування працівників шахрайських мереж, яке показало, що вони використовують LLM лише як допоміжний інструмент для вдосконалення своїх шахрайств. Причина цієї розбіжності, дійшли висновку дослідники, полягає в тому, що торгівля людьми може бути дешевшою та прибутковішою для шахрайських організацій, ніж ШІ. Це не лише тому, що це майже безкоштовна робоча сила — враховуючи, що табори часто поневолюють працівників без оплати або платять їм лише невеликий дохід, який тримає їх у борговій кабалі — але й тому, що ті самі жертви торгівлі людьми іноді викупаються за плату наприкінці свого перебування в шахрайському таборі. «Можливо, вони ще не відчувають потреби автоматизуватися», — каже Мірскі з Університету Бен-Гуріона в Негеві. «Це не тільки безкоштовна робоча сила, вони також отримують гроші за цих людей».
Проте результати дослідження свідчать про те, що індустрія шахрайства може незабаром перейти до більшої автоматизації за допомогою ШІ, каже Ерін Вест, колишній прокурор округу Санта-Клара, штат Каліфорнія, яка зараз очолює антишахрайську організацію Operation Shamrock. «Ми повинні дуже боятися того, що показує це дослідження», — каже Вест.
Широке використання чат-ботів ШІ може скоротити торгівлю людьми в індустрії шахрайства, але це також може зробити операції набагато складнішими для відстеження та боротьби, усунувши необхідність у великомасштабній інфраструктурі, такій як табори в Південно-Східній Азії, де розміщують та змушують працювати жертв торгівлі людьми. «Якщо одна з їхніх слабких сторін — це наймання людей і необхідність утримувати, годувати та контролювати їх, тепер їм не потрібно цього робити», — каже Вест. «Наше головне вікно до того, що вони роблять, — це ці дуже очевидні шахрайські табори. Тепер вони можуть робити це в двокімнатній квартирі когось».
Джерело новини: arstechnica.com
