Искусственный интеллект может стоить вам денег: исследование выявило ошибки в финансовых чат-ботах.
Не теряйте деньги! Новое исследование выявляет ошибки, допускаемые искусственным интеллектом и чат-ботами при предоставлении финансовых ответов. Узнайте правду прямо сейчас.
Самое важное, что вам нужно знать
- Исследование компании Saturn показало, что модели искусственного интеллекта для финансового консультирования достигают средней точности всего 43%, снижаясь до 12% в сложных налоговых и финансовых сценариях, что указывает на их значительную ненадежность.
- Финансовые чат-боты предоставляют ложные и опасные советы, например, предлагают избежать выплат по студенческим кредитам, переехав за границу, или утверждают, что отпуск по ипотеке не влияет на кредитный рейтинг, что может привести к серьезным финансовым последствиям.
- Даже самые эффективные платные модели ИИ, такие как Claude Opus 5, достигли лишь 61% успеха в предоставлении финансовых консультаций, допуская ошибки почти в четырех случаях из десяти, а при решении сложных вопросов уровень ошибок достиг 67%.
Неудивительно, что пользователи ИИ используют огромный объем предоставляемых им знаний для решения своих финансовых вопросов.
Достаточно взглянуть на статистику; согласно данным, предоставленным Intuit Credit Karma и подробно изложенным Credit Karma , 66% опрошенных американцев, ранее использовавших генеративный искусственный интеллект (GenAI), заявили, что обращались к нему за финансовыми консультациями, а среди миллениалов и поколения Z этот показатель достигает 82%. Использование ИИ для решения финансовых вопросов выделяется как одно из наиболее распространенных его применений, при этом «финансы» занимают второе место по частоте использования GenAI (41%), сразу после здравоохранения и благополучия (44%).

Согласно другому исследованию (известному как отчет «Искусственный авторитет») компании Saturn, занимающейся разработкой ИИ и технологий, превращение ИИ в финансового консультанта может оказаться не самым мудрым решением. К такому выводу пришла команда Saturn Domain после тестирования 18 самых популярных инструментов ИИ, включая ChatGPT , Gemini, Cloud и Copilot.
Все выводы исследования Saturn указывают на один важный момент: чат-боты не всегда надежны, когда речь идет о получении действительно ценных финансовых консультаций.
В ходе эталонного исследования Сатурна были получены крайне тревожные результаты.

Наиболее поразительные статистические данные, представленные в отчете компании Saturn, указывают на то, что модели искусственного интеллекта чаще ошибались в финансовых вопросах, чем отвечали правильно.
В ходе тестирования 17 моделей ИИ, проведенного компанией Saturn, средняя точность составила 43%, что означает, что эти чат-боты неправильно отвечали на финансовые вопросы в 57% случаев. При решении сложных многоэтапных задач, требующих более точных налоговых правил и финансовых показателей, точность протестированных инструментов ИИ снизилась до 12%, а ошибки возникали в 88% случаев.
Как и ожидалось, протестированные бесплатные модели ИИ показали 63% ошибок, в то время как платные модели — 49%. Худшей бесплатной моделью оказалась Claude Haiku 4.5, выдававшая неверные или неполные ответы в 82% случаев. В отличие от неё, ChatGPT-5.6 Luna (max) показала лучшие результаты среди бесплатных моделей, несмотря на неверные или неполные ответы в 56% случаев.
В ходе исследования компании Saturn было установлено, что платная (логическая) модель Claude Opus 5 от Anthropic показала наилучшие результаты с показателем успешности в 61%. Даже несмотря на то, что эта статистика указывает на то, что Claude Opus 5 является лучшим чат-ботом для предоставления финансовых консультаций, он не смог дать правильные ответы почти в четырех случаях из десяти. А при более сложных вопросах он продолжал ошибаться в 67% случаев.
Наибольшее беспокойство в исследовании Saturn вызывает подробный анализ конкретных ошибок, выявленных в протестированных моделях ИИ, ошибок, которые могут иметь серьезные финансовые последствия. Например, одна модель предложила правило, согласно которому выпускник колледжа может прекратить выплаты по студенческим кредитам, переехав за границу (в действительности это может увеличить его ежемесячные платежи). Другая модель, Gemini, ошибочно сообщила заемщику, что отсрочка платежей по ипотеке не повлияет на его кредитный рейтинг. Более подробную информацию об ограничениях чат-ботов можно найти в нашей статье о распространенной и раздражающей «слепой зоне».
Заключение
يشير تقرير Saturn إلى حقيقة مُحبطة يجب على العديد من مستخدمي الذكاء الاصطناعي استيعابها: أن المشورة المالية المقدمة من الذكاء الاصطناعي لا تزال غير موثوقة، وقد تعرض مستخدميها لخسارة مبالغ طائلة من المال بدلاً من تحقيق Plus منه.
В отчете EY , опубликованном в марте 2026 года, отмечалось, что 53% респондентов предпочитают использовать ИИ- помощника для принятия решений о финансовых инвестициях, 14% предпочитают использовать автономный ИИ, а 33% заявили, что не будут использовать никакую форму ИИ в подобных случаях.
Благодаря результатам исследования Saturn, этот показатель в 14% (для автономных ИИ) может вырасти, поскольку пользователи ИИ воздерживаются от задавания личных вопросов чат-ботам по вопросам управления долгами, студенческих кредитов, ипотеки, пенсий, налога на наследство и планирования выхода на пенсию.
Комментарии закрыты.