🤏ИИ ошибается в 57% ответов на финансовые вопросы, показал эксперимент с 18 моделями и более чем 10 тысячами запросов.
На сложных задачах с несколькими вычислениями доля ошибок достигала 88%: нейросети путались в расчетах, не учитывали изменения налоговых правил и ссылались на несуществующие нормы. Лучший результат среди протестированных моделей показал Claude Opus 5 в режиме «рассуждений» — 39% ошибок.
🚀@primebz📲@primebz
Post #2592
2.73K
- 🤔 24
- 👀 19
- 🫡 6
- 🤯 4
- 😁 1