Впечатления с ACM Web Conf 2024 - тренд LLM
Я понял, что впечатления о конфе не влезут в один пост, поэтому их будет несколько. Этот пост будет про захвативший всех тренд на LLM модели (ChatGPT и аналоги). И вправду во всех треках конференции наблюдались попытки применить LLM везде, где только можно.
Были достаточно очевидные идеи. Давайте выделять с помощью LLM признаки из текстов, задавая о них вопросы. Признаки будем использовать для улучшения рекомендаций.
Упоминались на первый взгляд нереалистичные идеи. Давайте скормим LLM описания товаров, которые человек посмотрел, а она нам сгенерирует товар, который нужно порекомендовать без доступа к акуальной базе данных товаров (спойлер, так пока не работает)
💎 Было очень крутое применение из области рекламы, которые выиграло приз лучшей статьи конференции. Статья от Google Research называется Mechanism Design for Large Language Models, что можно перевести как "Рекламные аукционы в LLM моделях".
Рассмотрим упрощенный пример, что вы спрашиваете ChatGPT: "Где можно съесть вкусный гамбургер?". LLM может сгенерировать ответ
- "Вы можете съесть вкусный гамбургер во Вкусно и точка" или
- "Вы можете съесть вкусный гамбургер в Бургер Кинге"
Суть статьи в том, как встроить аукцион за то, какая компания попадает в ответ.. В подходе есть проблема, что необходимо иметь отдельные LLM модели, каждая из которых обучена под конкретную компанию-рекламодателя. Дообучение LLM гораздо дешевле, чем обучение с нуля. Но все равно, дообучить LLM под условный Бургер Кинг кажется нетривиальным.
💎 Итого, ситуация с LLM похожа на компьютерную игру-квест, когда ты нашел новый предмет и пытаешься по очереди применить его на все другие предметы в игре, которые тебе доступны. Мой прогноз: будет много бреда, но через какое-то время точно появятся новые успешные применения LLM для существующих задач.
#tech
Post #186
1.24K