ИИ ошибается в 57% финансовых вопросов, на сложных — в 88%
Saturn протестировала 18 популярных ИИ-моделей на финансовых вопросах и выявила массовые ошибки: в среднем ChatGPT, Claude, Gemini, Copilot и Grok дают неверные ответы в 57% случаев, а при решении сложных задач процент ошибок достигает 88%. В одном из примеров неправильный совет Claude по налогам мог обойтись пользователю в 17 500 фунтов.
Исследование показывает, что ни одна из протестированных моделей не готова служить надёжным советником в финансовых вопросах.
Источник: Код.ру
- Alibaba выпустила Qwen Image 2.1 — единую модель для редактирования изображений 2026-09-20
- Alibaba выпустила Qwen-Image 2.1 с поддержкой прозрачности и редактированием в одной 2026-09-20
- Alibaba выпустила синхронный перевод речи на 60 языках с задержкой 2,3 секунды 2026-09-20
- Alibaba выпустила синхронный переводчик с задержкой 2,3 секунды 2026-09-20
Новости этого рынка выходят у нас в телеграме первыми — @wikicompass.
Комментарии из открытых обсуждений в телеграме, приведены дословно. Мнение авторов не редакция.