TGViewer
EFEMERA: AI news EFEMERA: AI news @ef9mera · 1.65K subscribers
Post #884 584
Исследование от Apple: иллюзия логики мышления LLM

◯ Apple опубликовало исследование, разоблачающее LLM с цепочкой размышлений
◯ Тестировали логику на задачах типа башни Ханоя (100+ шагов) и головоломки с усложнениями
◯ Модели не решают задачи, а ищут аналогичные примеры в базе данных
◯ В решении простых задач модели портят ответ, продолжая цепочку размышлений могут случайно испортить первое верное решение
◯ Увеличение размышлений не приводит к лучшим результатам
◯ Примеры пошагового решения не помогают - в незнакомых задачах модели "теряются"
◯ LLM успешнее решают башни Ханоя, но терпят неудачу с простыми логическими загадками
◯ Полный документ исследования (pdf)

💬 Возможно исследование и подсвечивает реальные проблемы, но надо проверять на практике. Apple бодро критикует не имея свои ИИ-модели... 🙃

@EF9MERA

Источник
  • 👍 6
  • 😢 5
  • ❤ 2
  • 👀 2
  • 👎 1
More from @ef9mera
  1. Sep 23, 2026Post #1796
  2. Sep 21, 2026В Сан-Франциско кожаного выпустили в клетку драться с почти 80-килограммовым гуманоидным р…
  3. Sep 21, 2026Post #1794
  4. Sep 18, 2026Post #1793
  5. Sep 14, 2026Post #1792
  6. Sep 10, 2026Post #1791
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →