Трансформеры становятся понятнее, когда можно «потыкать» модель напрямую.
Transformer Explainer — это интерактивный инструмент визуализации для изучения того, как работают текстогенерирующие модели на основе трансформеров, такие как GPT.
Он помогает связать архитектуру с реальным поведением, запуская живую GPT-2 прямо в браузере, позволяя вводить свой текст и показывая, как внутренние компоненты работают вместе для предсказания следующих токенов.
Ключевые возможности:
- Живая GPT-2 в браузере — экспериментируйте без настройки отдельного сервера модели
- Свой текст — пробуйте собственные промпты и смотрите, как модель их обрабатывает
- Внутренние компоненты — наблюдайте за операциями, работающими внутри трансформера
- Фокус на предсказании следующего токена — связывайте каждый визуальный шаг с предсказаниями модели
- Локальная разработка — клонируйте репозиторий, установите зависимости и запустите через npm для глубокого изучения
Это open-source (лицензия MIT).
https://github.com/poloclub/transformer-explainer
👉 @PythonPortal
Post #5922
5.29K

- ❤ 1