TGViewer
Прокачай Мозг: Айти, Тренды, Технологии Прокачай Мозг: Айти, Тренды, Технологии @ipumpbrain · 183K subscribers
Post #25665 7.14K
ИИ ошибается в 57% финансовых ответов, а на сложных вопросах — до 99%. Самые популярные модели ChatGPT, Claude, Copilot, Grok и Gemini в среднем давали на такие вопросы неверные ответы в 57% случаев.

При наиболее сложных вопросах, например требующих нескольких вычислений, модели ИИ допускали ошибки в 88% случаев. В рамках эксперимента 18 моделям задали более 10 тыс вопросов. Как итог: алгоритмы ошибались в расчетах, не учитывали изменения в налоговых правилах и ссылались на несуществующие нормы. К примеру, ошибка Claude Haiku в налоговых правилах могла обернуться для вкладчика огромным штрафом, а в вопросе о студенческих займах бот изобрел несуществующее правило об отмене выплат при переезде за границу. Наименьшая доля ошибок среди протестированных моделей была у Claude Opus 5 в режиме «рассуждений» — 39%.

Прокачай Мозг
  • 🤔 19
  • 👍 5
  • 😁 5
  • 🤯 5
More from @ipumpbrain
  1. Oct 6, 2026Найден самый оригинальный чемодан для путешествий в виде... пантеры. Но будьте готовы, что…
  2. Oct 6, 2026Кто должен уступить?
  3. Oct 6, 2026Оказывается, щенки померанских шпицев на взвешивании выглядят так, будто учёные обнаружили…
  4. Oct 5, 2026Подушка-антистресс в форме женской груди захайпила в сети. Её выпустил бренд Strollworks,…
  5. Oct 5, 2026Наушники, которые СКАНИРУЮТ МОЗГ — вышли Neurable One, которые получили 12 ЭЭГ-сенсоров пр…
  6. Oct 5, 2026Апдейт к недавнему бою кожаного с 80-килограммовым роботом в Сан-Франциско. Калифорнийская…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →