Популярные ИИ-модели ошибаются в финансовых вопросах более чем в половине случаев.
Популярные ИИ-модели ошибаются в финансовых вопросах более чем в половине случаев. ChatGPT, Claude, Copilot, Grok и Gemini в среднем дали неверные ответы на 57% запросов, а в сложных задачах с несколькими вычислениями доля ошибок доходила до 88%. Всего исследователи протестировали 18 моделей на более чем 10 тысячах вопросов.
314 просмотров