TGViewer
Мы из будущего Мы из будущего @empive · 3.89K subscribers
Post #8156 348
Новые ИИ-модели OpenAI чаще допускают галлюцинации в рассуждениях

OpenAI выпустила модели o3 и o4‑mini, которые, вопреки исторической тенденции, галлюцинируют чаще предыдущих (o1, o1‑mini, o3‑mini, GPT‑4o). В тесте PersonQA o3 ошибалась в 33% случаев (ранее ~15%), o4‑mini — в 48%. Независимые проверки выявили выдуманные действия, например, ложный запуск кода на MacBook.

По мнению экспертов, проблема может быть связана с особенностями обучения с подкреплением. Один из возможных путей решения — подключение моделей к веб-поиску, как это уже реализовано в GPT-4o, показавшей высокую точность ответов. OpenAI заявила, что активно работает над снижением числа галлюцинаций.

Мы из будущего
  • 🤔 4
More from @empive
  1. Oct 8, 2026Медицина уже меняется — и некоторые вещи ещё недавно казались фантастикой 🚀 За последние…
  2. Oct 4, 2026Август и сентябрь в биотехнологиях: что произошло 🧬 За последние два месяца в биотехнолог…
  3. Aug 2, 2026Post #8412
  4. Aug 1, 2026⚡ ГЛАВНЫЙ ВЫВОД ИЮЛЯ 2026 Будущее перестало быть набором отдельных технологий. Оно начинае…
  5. Jul 31, 2026⚡ ГЛАВНЫЙ ВЫВОД ИЮНЯ Будущее больше не строится вокруг одной технологии. Самая мощная комб…
  6. Jul 30, 2026🧬 8. Цифровой двойник постепенно становится медицинским инструментом Одна из самых перспе…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →