TGViewer
ТОПОР - Горячие новости ТОПОР - Горячие новости @topor · 1.3M subscribers
Post #52535 86.6K
ИИ ошибается больше чем в половине финансовых ответов.

В тесте 18 моделей, включая ChatGPT, Claude, Copilot, Grok и Gemini, средняя доля ошибок составила 57%, а на сложных задачах с несколькими вычислениями — 88%.

Модели путались в расчётах, не учитывали изменения налоговых правил и ссылались на несуществующие нормы.

Лучше всех выступил Claude Opus 5 в режиме рассуждений, но и он ошибался в 39% случаев.
More from @topor
  1. Sep 21, 2026Перед вами молекулярный курьер, который работает внутри наших клеток 24 на 7. Этот белок б…
  2. Sep 21, 2026Виталий Милонов опять станет депутатом Госдумы. Он набрал более 50% голосов в одномандатно…
  3. Sep 21, 2026Кадыров набирает 99,85% голосов на выборах главы Чечни — это его рекордный результат. Подс…
  4. Sep 20, 2026Грузовик на скорости влетел в очередь на заправку на МКАДе. В массовой аварии один человек…
  5. Sep 20, 2026В Китае нашли аэропорт с бесплатным пивом. Пенное доступно всем туристам. Вот куда нужно л…
  6. Sep 20, 2026Партия Пенсионеров выдвинула на выборы кандидата 2005 года рождения. Знаете, я и сам своег…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →