Искусственный интеллект
# искусственный интеллект

Опасная точность: исследование выявило критический уровень ошибок нейросетей при консультировании по финансовым вопросам

Опасная точность: исследование выявило критический уровень ошибок нейросетей при консультировании по финансовым вопросам
Исследование компании Saturn выявило критический уровень ошибок ИИ при ответах на финансовые вопросы. Использование нейросетей для консультаций может привести к крупным денежным потерям.

Популярность искусственного интеллекта в повседневных задачах создает серьезную угрозу для личных финансов пользователей из-за крайне низкой точности ответов на специализированные запросы. Как сообщает издание Financial Times, опираясь на данные технологической компании Saturn, современные ИИ-модели в большинстве случаев предоставляют недостоверную информацию, когда речь заходит о деньгах.

Проблема заключается в систематической неспособности алгоритмов корректно обрабатывать финансовые данные. Согласно отчету, такие системы, как ChatGPT, Claude, Copilot, Grok и Gemini, ошибались в более чем половине (57%) ответов на общие финансовые темы. Ситуация становится катастрофической при усложнении задачи: в вопросах, требующих проведения цепочки расчетов, частота ошибок возрастает до 88%, а в отдельных случаях точность падает до критического минимума — ошибки встречаются в 99% ответов.

В ходе масштабного эксперимента аналитики протестировали 18 различных ИИ-моделей, задав им более 10 тысяч вопросов. Исследователи использовали более 100 различных финансовых сценариев, проверяя как бесплатные, так и платные версии ChatGPT, Gemini, Claude и Copilot, причем каждый вопрос дублировался до пяти раз для проверки стабильности результата.

Выявленные дефекты работы нейросетей варьируются от простых арифметических промахов до опасной дезинформации. Алгоритмы могут игнорировать грядущие реформы в налоговом законодательстве или полностью выдумывать несуществующие правовые нормы. Генеральный директор компании Saturn Амаль Джолли подчеркивал, что миллионы людей доверяют нейросетям советы по управлению капиталом, не осознавая, что цена неверной рекомендации может быть крайне высокой.

Конкретные примеры демонстрируют масштаб потенциальных убытков. Так, из-за неверной интерпретации правил налогообложения пенсионных накоплений модель Claude Haiku 4.5 могла спровоцировать британского налогоплательщика на выплату штрафа в размере 17,5 тысяч фунтов стерлингов в пользу налогового ведомства Великобритании HM Revenue & Customs. В другом случае нейросеть Claude предоставила ложную информацию о студенческих кредитах, выдумав правило, позволяющее прекратить выплаты при эмиграции.

Хотя платные версии и более новые итерации алгоритмов демонстрируют лучшую результативность, они не застрахованы от промахов. Даже лидирующая модель Claude Opus 5 в режиме «рассуждений» (reasoning) допускала ошибки в 39% случаев. При этом эксперты не исключают полезность ИИ для вспомогательных задач, таких как анализ структуры личного бюджета или поиск зон избыточных трат при сопоставлении доходов и расходов.

Особую тревогу вызывает отсутствие правового поля. Амаль Джолли отметил, что финансовое консультирование с помощью ИИ на данный момент не регулируется, что лишает пользователей возможности получить компенсацию в случае ущерба, доступной при работе с профессиональным консультантом. По его словам, Управление по финансовому регулированию и надзору Великобритании (FCA) уже начало изучать этот вопрос, но меры по защите потребителей должны быть приняты незамедлительно.

Ситуация осложняется растущим доверием населения к технологиям. Согласно данным FCA, каждый пятый взрослый житель Великобритании готов делегировать ИИ принятие важных решений, особенно в сложных сферах, таких как управление долгами, инвестиции и пенсионные накопления. Молодые инвесторы проявляют еще большую склонность к автоматизации: две трети из них планируют наращивать использование ИИ в ближайший год, предпочитая его финансовым блогерам и медиа.

Глобальный тренд на использование алгоритмов наблюдается и в других регионах. Исследование российского аналитического центра ВЦИОМ показало, что 65% российских покупателей учитывают советы рекомендательных систем и ИИ при совершении онлайн-покупок. Несмотря на то, что большинство пользователей (59%) готовы использовать ИИ как помощника, но хотят сохранять за собой право финального решения, значительная часть потребителей (37%) по-прежнему предпочитает полностью самостоятельный выбор без участия технологий.

Видео для новости

Похожие новости

Здесь может быть ваша реклама