🤖 ИИ ошибся в 88% сложных финансовых вопросов — исследование
Компания Saturn проверила 18 моделей ChatGPT, Claude, Copilot, Grok и Gemini на более чем 10 000 запросов. В среднем ответы были неверными в 57% случаев, а в задачах с несколькими расчетами — в 88%.
Чатботы путались в вычислениях, игнорировали изменения налоговых правил и выдумывали собственные. В одном из тестов ошибка Claude могла обойтись пенсионному вкладчику в £17 500.
Платные модели справлялись лучше бесплатных, но даже лучший результат в сложных задачах — 39% ошибочных ответов.
Tokensales | News | Incrypted Plus
Post #32769
4.52K

- 😁 21
- 👍 4
- 👏 3