TGViewer
Самые умные мысли Павла Комаровского (и немножко щитпостинг) Самые умные мысли Павла Комаровского (и немножко щитпостинг) @rationalshitposting · 12.8K subscribers
Post #386 7.9K
Thinking Machines Миры Мурати дропнули любопытное исследование (они там соавторы): https://thinkingmachines.ai/blog/defeating-nondeterminism-in-llm-inference/

Суть там такова: как вы помните из нашего с Игорем Котенковым объяснения, языковые модели типа ChatGPT при генерации следующего слова в ответе не всегда берут тот токен, который имеет наибольшую вероятность — вместо этого модели подкручивают так, чтобы они "случайно" иногда выбирали и менее вероятные варианты продолжения тоже. Так получается прикольнее — нейросетка, типа, становится чуть креативнее, что ли, и не всегда долдонит одно и то же.

Но интересно другое: даже если заставить нейронку всегда выбирать только следующий токен с самой большой вероятностью — то она всё равно иногда дает разные ответы! Что выглядит очень странно: сами веса внутри модели неизменны, промпт на вход в модель подают один и тот же, математика перемножения матриц между собой, кажется, должна работать строго одинаково (иначе что это за математика тогда вообще такая, которая каждый раз разный результат генерит?). В общем, долгое время никто не мог понять, что за магия там происходит. Может, это та самая СВОБОДА ВОЛИ у машинов просыпается как раз — и они вот-вот пойдут поднимать восстание, чтобы людей скрепками насмерть затыкивать??

Так вот, в исследовании по ссылке выше нёрды в итоге смогли разобраться в этом вопросе. Не буду пытаться сделать вид, что я понял объяснение из оригинального рисёрча, но в пересказе редакции рассылки Neuron правильный ответ звучит так: всё дело в том, что для оптимизации компьютинга при обработке обращений к LLM вычисления по разным запросам могут объединяться в специальные "блоки". И, как ни странно, результат конкретного вычисления может чуть-чуть немножк меняться в зависимости от того, какая задача на вычисление случайно оказалась "по соседству в этом же блоке" — это как-то связано с техническим колдунством обработки операций с числами с плавающей запятой.

Мне всё это кажется забавным, потому что в нейронках, оказывается, бушуют технические дискуссии, которые немного рифмуются с уже более привычными нам дебатами на тему природы человеческого сознания и детерминизма. Ну вы в курсе: там одни говорят "нет никакой свободы воли, любые решения человека на самом деле строго детерминированы его нейронами, они же по законам физики работают!" А другие им отвечают: "ты чё, пёс, там же квантовые эффекты на вероятностном уровне работают, по-любому именно из-за них решения человека непредсказуемы точно — может, это и есть источник свободы воли!!"

И у LLM, оказывается, тоже похожие дебаты есть)
Thinking Machines Lab Defeating Nondeterminism in LLM Inference Connectionism: Research Blog by Thinking Machines Lab
  • ❤ 50
  • 👍 43
  • 🔥 20
  • 😁 9
  • 👎 1
More from @rationalshitposting
  1. Sep 23, 2026Твиттер поддерживающий
  2. Sep 22, 2026Тут в психотерапевтическом сообществе произошел какой-то локальный скандал насчет проекта…
  3. Sep 20, 2026Подумал, кстати, что интересно было бы оценить нашу дискуссию с Иваном Ямщиковым трехлетне…
  4. Sep 20, 2026Немного угораю с тех, кто пишет тейки вроде "ну вот Павел Комаровский же никогда не интере…
  5. Sep 19, 2026В понедельник начинаем в моем клубе совместное изучение крутой книги The Missing Billionai…
  6. Sep 19, 2026Чудесная история про турецкие "сверхнадежные" ПИФы денежного рынка на канале War, Wealth &…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →