TGViewer
Post/work | левый акселерационизм Post/work | левый акселерационизм @post_work · 1.88K subscribers
Post #2138 1.16K
​​Новое исследование от Apple только доказало, что такие "рассуждающие" модели ИИ, как Claude, DeepSeek-R1 и o3-mini, на самом деле вовсе не рассуждают, а лишь хорошо запоминают паттерны.

Казалось бы, мы говорим очевидные вещи, но не для всех сторонников или противников ИИ это очевидно. Apple протестировала Claude Thinking, DeepSeek-R1 и o3-mini на задачах, с которыми эти модели никогда раньше не сталкивались. По мере усложнения задач эти языковые модели использовали меньше жетонов и быстрее сдавались, несмотря на неограниченный бюджет. Исследователи Apple даже попробовали дать моделям точный алгоритм решения, но они по-прежнему терпели неудачу на тех же уровнях сложности.

Apple, тем самым, экспериментально обнаружила, что эти модели вовсе не рассуждают, а занимаются сложным подбором шаблонов и запоминанием паттернов, который отлично работает, пока шаблоны не становятся слишком сложными. Если бы эти модели действительно "рассуждали", они должны были бы становиться лучше с увеличением количества вычислений и более четких инструкций.

Произошло то, о чём мы всегда писали — LLM - это не про рассуждения. Они больше похожи на глобальный хэш-консолидатор, базу данных памяти, используемую всем человечеством, на всех языках программирования. Это чрезвычайно мощный инструмент, который позволит продвинуться во многих областях, но не к общему искусственному интеллекту. Большинство людей упускает из виду реальные достижения нейросеток: массивные вычисления, добавленные к простому алгоритму, дают огромную силу в большом масштабе. Возможно, впереди исследования по децентрализации языковых моделей, их обобщения, когда для каждой конкретной сферы будет конкретная ЛЛМ со своим набором данных и с открытым кодом.
  • 🔥 18
  • 👎 2
  • 🤣 1
More from @post_work
  1. Sep 19, 2026Наш друг и товарищ Андрей Денисов перевёл ранее эссе Марка Фишера Белая магия про способно…
  2. Sep 19, 2026Post #2393
  3. Sep 16, 2026«Медиаискусство сегодня: теория и практика» Курс рассчитан на начинающих авторов и студент…
  4. Sep 14, 2026На выходных читал две интересные статьи про планетарный интеллект и рекурсивное самосоверш…
  5. Sep 12, 2026Post #2387
  6. Sep 10, 2026Будущее — это не череп Терминатора, а милый котёнок? Михаил Федорченко перевёл разговор Ма…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →