TGViewer
Industrial Ai | Stanislav Dmitriyev Industrial Ai | Stanislav Dmitriyev @stas_dmitriyev · 258 subscribers
Post #148 72
💡 У вас не появилось ощущение что модели Ai стали выдавать все более скучные ответы?

Есть уже популярное мнение: «AI стал скучным, потому что его задушили выравниванием». Типа RLHF, safety и всё такое — и модели потеряли креативность.

Звучит логично. Но, как выяснилось, всё немного интереснее.

Ребята из Stanford University разобрали тысячи человеческих оценок (датасет HelpSteer) и нашли неожиданное: проблема не в моделях, а в людях.

Когда мы оцениваем ответы, мы выбираем не лучший — а самый привычный. Самый «нормальный». Самый ожидаемый.

И модель просто учится этому соответствовать. Мы сами постепенной учим модели быть отстойными 😀

Отсюда и эффект: просишь «шутку» — получаешь максимально безопасную и предсказуемую версию. Не потому что модель не умеет лучше, а потому что так её научили.

Но вот где начинается магия.

Если вместо:
«Напиши шутку про кофе»

попросить:
«Сгенерируй 5 шуток про кофе с вероятностями»

— модель внезапно начинает выдавать сильно более разнообразные и креативные ответы.

Почему?
Потому что ты просишь не «лучший ответ», а выборку из распределения. И она достает то, что было «спрятано» после выравнивания.

Результаты в исследовании (там есть PDF):
— до 2× рост разнообразия
— до +25% в человеческой оценке качества
— до 66% восстановления «креативности» базовой модели


И самое интересное: чем мощнее модель — тем больше у неё «запертой» креативности.

Вывод получается довольно неожиданный.

AI не стал тупее, модель не стала скучной.
Ты просто каждый раз просишь её быть «нормальной»
😄

Сайт: verbalized-sampling.com
arXiv.org Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity Post-training alignment often reduces LLM diversity, leading to a phenomenon known as mode collapse. Unlike prior work that attributes this effect to algorithmic limitations, we identify a...
  • 🔥 3
More from @stas_dmitriyev
  1. Oct 4, 20262025: «Нам нужна AI strategy». 2026: «Нам нужен AI agent». 2027: CFO: «Мне всё равно, как…
  2. Oct 4, 2026🔍 Data Center Valley в Экибастузе: Казахстан подтверждает цель минимум 1 GW На AI & Digit…
  3. Oct 4, 2026🔍 Главный вопрос AI-индустрии теперь не «сколько GPU», а «где возврат на этот CAPEX» Reut…
  4. Oct 3, 2026🔍 Американский бизнес распробовал открытые модели ИИ Интересная статья Financial Times: к…
  5. Oct 3, 2026🔍 Anthropic вкладывает $100 млн в подготовку 10 000 инженеров по внедрению ИИ Компания за…
  6. Oct 3, 2026🔍 Цифровые двойники — минимум на 60% крупных промышленных предприятий Казахстана к 2029 г…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →