TGViewer
Kantor.AI Kantor.AI @kantor_ai · 12.2K subscribers
Post #832 3.04K
Казалось бы, зачем рекомендательной системе что-то генерировать?

Нам же надо выбрать человеку существующий трек, а не сочинить новый. Но генерировать можно идентификатор этого трека. У Алексея Гусакова на deep tech night как раз был доклад про то, как Яндекс дошел до генеративных рекомендаций без ручного фичеинжиниринга.

Начиналось все довольно привычно: BERT превращает историю прослушиваний в вектор пользователя, дальше ищем близкие векторы треков. В версии 2023 года модель учитывала историю из 128 треков. Потом появился Argus: идея была в том, чтобы предсказывать следующий трек примерно так же, как LLM предсказывает следующий токен. Обучение стало вычислительно эффективнее, историю удалось увеличить до 8000 треков.

Но оставалась неприятная особенность: всю историю пользователя сжимали в один вектор, а подходящие треки искались через простую функцию близости, плюс еще был каскад отбора кандидатов. В итоге это приводило к тому, что если хороший трек потерялся на раннем этапе, можно сколько угодно улучшать финальный ранжировщик, но этот трек пользователь уже не увидит.

В новой модели SONA трек представляют последовательностью из трех кодов, Semantic ID. Их получают из текста и аудио, причем коды сохраняют музыкальную семантику: у похожих треков могут совпадать первые компоненты. Дальше модель учится генерировать эту последовательность и одновременно ранжировать кандидатов по ожидаемому отклику пользователя. То есть next token prediction, только на выходе рекомендация, а не ответ в чатике.

По данным команды, в A/B-тесте SONA дала около +4,5% к числу активных пользователей. Причем поверх предыдущих улучшений, а не относительно какого-нибудь древнего бейзлайна.

Мне как человеку, успевшему позаниматься рекомендашками, и потому к ним неравнодушному, доклад понравился тем, что показывает как успешно прикручивать NLPшные методы к привычным задачам вроде построения рекомендательных систем. И, кстати, перетаскивание методов из NLP в RecSys и обратно всегда было рабочей идеей - есть много похожего в данных.
  • 👍 9
  • ❤ 8
More from @kantor_ai
  1. Oct 1, 2026GPT Model Hub: готовые ИИ-модели по API в MWS Cloud Platform GPT Model Hub – это сервис MW…
  2. Oct 1, 2026Вчера выступал на YaC/e (Yet Another Conference on education) в Яндексе, постил про нее чу…
  3. Sep 29, 2026Свершилось: свой претрейн Я уже ранее писал, почему в России всё ещё нет своей конкурентос…
  4. Sep 29, 2026В тему «думать, пока пишешь текст», мне кажется это работает как «советы давать или делать…
  5. Sep 29, 2026Зачем нам писать тексты самим, если есть ИИ Последнее время постоянно прошу LLM оценивать…
  6. Sep 28, 2026Конференция Яндекса про образование YaC/e стартует уже через 2 дня 30 сентября 2026 года в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →