TGViewer
Временно Степан Временно Степан @psyreq · 122 subscribers
Post #41 127
Привет
На связи Степан 😎

В интернете сегодня шумит исследование ученых из Apple о рассуждающих моделях вроде Claude 3.7, o3 и тд (наверное, это те самые ученые, которые не спешат помогать Siri становиться умнее). Думаю, вы уже видели в пабликах разные мысли и выводы на этот счет.

Вкратце расскажу, если не видели:
- есть большие сомнения в способности моделей к рассуждению, модели только имитируют мыслительный процесс (тут хочется воскликнуть "да ладно, а что вы ожидали-то?");
- и "думающие" и "не думающие" модели не справляются с задачами высокой сложности, причем "не думающие" лучше справляются с легкими задачами, а "думающие" - с задачами средней сложности;
- у "думающих" моделей есть overthinking problem (прямо как у людей).

На днях слушал выпуск подкаста "Запуск завтра" на схожую тему и отлично совпало, что в подкасте дали хороший комментарий по первому пункту.

Создав машину, пытающуюся мыслить, человечество задумалось о правильности ее мыслительного алгоритма. Но тут проблема - сами до конца не знаем, как происходит процесс мышления. И не знаем, есть ли во вселенной только один рабочий паттерн - человеческий, либо их может быть много. Короче, сплошная философия. И чтобы не тормозить прогресс, в какой-то момент решаем, что оценить способности ИИ к мышлению можно по конечному результату и в целом, не так важно, как именно ИИ к нему пришел. И вот исследование ученых из Apple как раз затрагивает вопрос, а не пора ли перейти к иной оценке результативности ИИ.

Будет смешно, если вместо допилки Apple Intelligence (чтобы в Европе заработал или не слал тупые саммари, которыми пестрит reddit), эпл даст импульс к появлению Skynet'а. Потому что их ученые вот тут исследование запилили, чем спровоцировали смену подхода к оценке ИИ.

На этом моменте начинаются: Терминатор / Бегущий по лезвию / Я, робот / West World / Матрица / Из машины / Эра альтрона.
Apple Machine Learning Research The Illusion of Thinking: Understanding the Strengths and Limitations of Reasoning Models via the Lens of Problem Complexity Recent generations of frontier language models have introduced Large Reasoning Models (LRMs) that generate detailed thinking processes…
  • ❤ 7
More from @psyreq
  1. Sep 24, 2026Всем доброго четвергового утра!😎 Сегодня необычный пост: ищу бизнес-аналитика на небольшо…
  2. Sep 23, 2026Не весь AI-content это slop, или вот вам шикарный ролик с просторов threads. Мини-история:…
  3. Sep 15, 2026Необязательное продолжение про скиллы. Как подойти к сборке своего скилла, чтобы не закопа…
  4. Sep 15, 2026Зачем нужны скиллы (особенно, когда у тебя каждую неделю новая LLM) На связи Степан😎 Сего…
  5. Sep 10, 2026Смотрел вчера презентацию Apple (почти как Голубой огонек для моих родителей, ежегодное со…
  6. Sep 6, 2026Поюзал GPT-6 Astra на выходных 💻 Запускал с телефона, потому что весь тредс пестрит поста…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →