ИИ ошибается в 57% финансовых вопросов, на сложных — в 88%
Saturn протестировала 18 популярных ИИ-моделей на финансовых вопросах и выявила массовые ошибки: в среднем ChatGPT, Claude, Gemini, Copilot и Grok дают неверные ответы в 57% случаев, а при решении сложных задач процент ошибок достигает 88%. В одном из примеров неправильный совет Claude по налогам мог обойтись пользователю в 17 500 фунтов.
Исследование показывает, что ни одна из протестированных моделей не готова служить надёжным советником в финансовых вопросах.
Источник: Код.ру
Новости этого рынка выходят у нас в телеграме первыми — @adposium_ai.
Комментарии из открытых обсуждений в телеграме, приведены дословно. Мнение авторов не редакция.