Популярные ИИ-модели ошибаются в финансовых вопросах более чем в половине случаев.
ChatGPT, Claude, Copilot, Grok и Gemini в среднем дали неверные ответы на 57% запросов, а в сложных задачах с несколькими вычислениями доля ошибок доходила до 88%. Всего исследователи протестировали 18 моделей на более чем 10 тысячах вопросов. @rus_buzines
Post #10074
5.12K
- 👍 11
- 😱 5
- 🔥 1