Как собрать свою GPT с нуля и наконец понять, что у LLM внутри?
https://stepik.org/a/276236
Большинство работает с языковыми моделями как с чёрным ящиком: вызвал API - получил ответ. Но на собеседованиях и в реальных задачах всё чаще нужно понимать, как модель устроена под капотом:
• Как текст превращается в токены и векторы?
• Как на самом деле работает механизм внимания (attention)?
• Что происходит внутри трансформер-блока?
• Как модель обучается и начинает генерировать текст?
• Как из простых формул собирается работающая GPT?
Курс «Математика LLM - Создаём большую языковую модель своими руками проведёт вас от нуля до собственной мини-GPT. Каждый слой пишем и считаем сами, а не берём готовым из библиотеки.
Внутри:
✔️ GPT-трансформер с нуля на чистом Python, без «магии» готовых библиотек
✔️ 15 модулей: от мини-математики и Python до обучения и генерации
✔️ 108 уроков, 330 шагов и более 150 проверочных заданий
✔️ Токенизация, эмбеддинги, attention, Multi-Head, FFN, training loop
✔️ Математика каждого шага на простых примерах + рабочий код
✔️ Своя мини-GPT в финале - её можно запускать, дообучать и менять
✔️ Проверка знаний после каждого модуля
✔️ Ответы автора прямо в комментариях к шагам
🎁 Для подписчиков канала промокод SUBS на скидку 20%.
Post #1215
756
- 👍 3
- 🔥 2
- 🤣 1