2026-09-20 · ИТ и разработка

ИИ ошибается в 57% финансовых вопросов, на сложных — в 88%

ИИ ошибается в 57% финансовых вопросов, на сложных — в 88%

Saturn протестировала 18 популярных ИИ-моделей на финансовых вопросах и выявила массовые ошибки: в среднем ChatGPT, Claude, Gemini, Copilot и Grok дают неверные ответы в 57% случаев, а при решении сложных задач процент ошибок достигает 88%. В одном из примеров неправильный совет Claude по налогам мог обойтись пользователю в 17 500 фунтов.

Исследование показывает, что ни одна из протестированных моделей не готова служить надёжным советником в финансовых вопросах.

Источник: Код.ру

Что говорят

Saturn сама разрабатывает ИИ-инструменты для финансовых консультантов и выступает за регулирование финансовых советов универсальных чат-ботов. Поэтому результаты отражают методику и критерии оценки самой компании. Понятно)

Neuromancer · @d_code

Комментарии из открытых обсуждений в телеграме, приведены дословно. Мнение авторов не редакция.

Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.

Все новости