Штучний інтелект помиляється у половині фінансових запитань — нове дослідження

Штучний інтелект не завжди дає надійні відповіді на фінансові запитання.

Використання ШІ для пошуку фінансових порад стає дедалі популярнішим. Згідно з даними Intuit Credit Karma, 66% американців, які користувалися генеративним ШІ, зверталися до нього по фінансові поради. Серед молоді (Gen Z та Міленіали) цей показник сягає 82%. Фінансова сфера посідає друге місце серед найпоширеніших сфер застосування генеративного ШІ (41%), поступаючись лише здоров’ю та добробуту (44%).

Однак, згідно зі звітом “Artificial Authority” від компанії Saturn, яка спеціалізується на ШІ та технологіях, використання ШІ як фінансового консультанта може бути не найрозумнішим рішенням. Команда Saturn дійшла такого висновку після тестування 18 популярних ШІ-інструментів, зокрема ChatGPT, Gemini, Claude та Copilot.

Штучний інтелект помиляється у половині фінансових запитань — нове дослідження 1

Результати дослідження Saturn вказують на те, що чат-боти не надто надійні, коли йдеться про надання кваліфікованих фінансових консультацій.

Дослідження Saturn виявило тривожні результати

Штучний інтелект помиляється у половині фінансових запитань — нове дослідження 2

Найбільш показовою статистикою зі звіту Saturn є те, що ШІ-моделі частіше помилялися, ніж давали правильні відповіді на фінансові запитання.

Загалом, 17 протестованих ШІ-моделей показали середній рівень точності 43%, що означає, що вони неправильно відповідали на фінансові запитання у 57% випадків. У складних, багатоетапних сценаріях, пов’язаних з податковим законодавством та точними фінансовими показниками, точність протестованих ШІ-інструментів знизилася до 12%, при цьому помилки становили 88%.

Не дивно, що безкоштовні ШІ-моделі мали показник невдач 63%, тоді як платні моделі показали 49%. Claude Haiku 4.5 було визнано найгіршою безкоштовною моделлю, оскільки вона надавала неправильні або неповні відповіді у 82% випадків. ChatGPT-5.6 Luna (max) став найкращою безкоштовною моделлю, хоча й він надавав неточні або неповні відповіді у 56% випадків.

Серед усіх протестованих моделей, платна модель Claude Opus 5 від Anthropic (reasoning) показала найкращі результати, досягнувши показника успішності 61%. Однак, навіть ця модель надавала правильні відповіді лише у 6 із 10 випадків. При відповідях на складніші запитання вона все ще припускалася помилок у 67% випадків.

Ще більш тривожним аспектом дослідження Saturn є глибокий аналіз специфічних помилок, які припускалися ШІ-моделями та могли б мати серйозні фінансові наслідки. Наприклад, одна модель запропонувала правило, згідно з яким випускник коледжу міг би призупинити виплату студентських позик, переїхавши за кордон (насправді, це могло б призвести до збільшення щомісячних виплат). Крім того, модель Gemini помилково повідомила позичальнику, що тимчасова відстрочка іпотечного платежу не вплине на його кредитний рейтинг.

Висновок

Звіт Saturn підкреслює сувору реальність, яку повинні усвідомити багато користувачів ШІ: фінансові поради від ШІ залишаються ненадійними і можуть призвести до значних фінансових втрат, а не до примноження капіталу.

Згідно зі звітом EY за березень 2026 року, 53% респондентів віддають перевагу використанню ШІ-асистента для прийняття фінансових інвестиційних рішень, 14% обирають автономний ШІ, а 33% заявили, що взагалі не користувалися б ШІ для таких цілей.

Завдяки висновкам Saturn, цей показник у 14% може зрости, оскільки користувачі ШІ уникатимуть ставити чат-ботам особисті запитання щодо управління боргами, студентських позик, іпотеки, пенсій, податку на спадщину та пенсійного планування.

Штучний інтелект помиляється у половині фінансових запитань — нове дослідження 3

Слідкуйте за Tom’s Guide на Google News та додайте нас до рекомендованих джерел, щоб отримувати актуальні новини, аналітику та огляди.

Більше від Tom’s Guide

  • Nvidia стверджує, що “локальний ШІ вже тут” – і це може змінити спосіб використання ШІ вдома
  • Новий трекер реклами OpenAI може знати, що ви робите після виходу з ChatGPT – ось що нам відомо
  • Відкрито сайт щодо колективного позову Apple на 250 мільйонів доларів – ось як власники iPhone можуть подати заявку та скільки отримають
Штучний інтелект помиляється у половині фінансових запитань — нове дослідження 4

Елтон Джонс

AI Writer

Елтон Джонс пише про ШІ для Tom’s Guide, тестуючи останні моделі, від ChatGPT до Gemini та Claude, щоб визначити, які інструменти працюють найкраще та як вони можуть покращити повсякденну продуктивність.

Він також є досвідченим технічним автором, який понад десятиліття висвітлює відеоігри, мобільні пристрої, гарнітури та тепер штучний інтелект. З 2011 року його роботи з’являлися у таких виданнях, як The Christian Post, Complex, TechRadar, Heavy та ONE37pm, з акцентом на чіткому, практичному аналізі.

Сьогодні Елтон зосереджений на тому, щоб зробити ШІ більш доступним, розбиваючи складні теми на корисні, легкі для розуміння інсайти для широкого кола читачів.

За матеріалами: www.tomsguide.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *