🤖 Як насправді працюють LLM — інтерактивна екранізація лекції Карпаті.
Хтось (автор Ynarwal) взяв культову лекцію Андрія Карпаті «Intro to Large Language Models» і перетворив її на інтерактивний веб-гайд з анімованими діаграмами, живим токенайзером і клікабельними етапами пайплайна.
По змісту — повний цикл від сировини до асистента:
→ Збір і фільтрація даних
→ Токенізація через Byte Pair Encoding (з живою демкою)
→ Архітектура трансформера і динаміка тренування
→ Інференс і семплінг токенів
→ Поведінка базової моделі
→ SFT і RLHF post-training
→ Галюцинації, типи памʼяті, tool use, RAG
Цільова — розробники, студенти, усі, хто хоче зрозуміти, як LLM працює всередині, без занурення у ML-математику. На проходження з усіма інтерактивами — 15-20 хвилин.
Особисто вважаю, що лекція Карпаті досі найкраща точка входу в тему. Відео на 1 годину лякає, а така версія читається як розумна стаття — плюс можна тицяти у візуалізації та бачити, як токенайзер реально ріже текст.
Безплатно, у браузері, без реєстрації.
https://ynarwal.github.io/how-llms-work/
📎 Читайте також:
→ Карпаті показав свою базу знань — markdown замість RAG
→ Карпаті випустив autoresearch — автономні ML-експерименти
→ Claude рендерить інтерактивні діаграми в чаті
Post #2972
423
- 🔥 7