Компании боятся, что их данные украдут. Пользователи опасаются, что нейросеть запоминает каждое слово. Разработчики сомневаются, стоит ли учить модель на реальных диалогах. В новом выпуске подкаста Pro Данные разбираемся, где правда, а где — мифы.
Вместе с экспертами рассказываем:
➡️ зачем на самом деле хранятся диалоги с ИИ;
➡️ как обучают большие модели: RLHF, DPO, GRPO;
➡️ как работает долгосрочная память (спойлер: модель здесь ни при чём);
➡️ что нельзя отправлять в облачные LLM;
➡️ где взять данные для обучения.
Гости выпуска:
♦️Ольга Погорельцева, аналитик MWS, ведущая
♦️Павел Бабин, директор по продукту MWS GPT
♦️Анна Богомазова, ex-руководитель по машинному обучению MWS GPT
Слушайте и смотрите на удобной платформе:
📹 ВК Видео
📹 YouTube
🎧 Mave
🎧 Яндекс Музыка
🎧 Apple Podcasts