Если вы пропустили наш митап по внедрению GenAI в обслуживание
То мы его записали: YouTube и ВК. Там 4 крутецких доклада:
1. Вводный про стратегию и платформу
2. Как мы замеряем качество агентов
3. Про спекулятивный декодинг
4. GenAI поверх интерфейсов сотрудников.
Рекомендую смотреть ровно в таком порядке. Ссылки на презентации на странице мероприятия.
Будут еще крутые митапы, где мы будем собираться нашем уютном комьюнити и делиться, как внедрять агентиков в суровый энтерпрайз.
Честно. Технологично. И с чувством юмора :)
Post #146
4.23K
YouTube Как мы используем спекулятивное декодирование для ускорения LLM инференса — Владислав Кругликов Разобрали:
→ Основные причины, почему LLM медленно генерируют ответы.
→ Как спекулятивное декодирование ускоряет генерацию без потери качества.
→ Популярные методы в индустрии.
→ Что вам делать на практике.
- ❤ 26
- 🔥 19
- ❤🔥 6
- 👍 4
- 🎉 2
- 🙏 2
- 🐳 2
- 🤩 1