Как данные проходят путь от внешнего сервиса до базы и готового дашборда?
25 сентября разберём этот процесс на практике вместе с Валерией Елпатьевской, инженером данных в Альфа-Банке. Возьмём GitHub как источник: получим данные о репозиториях, коммитах и языках программирования, обработаем их и загрузим в локальную базу DuckDB.
На вебинаре вы:
➡️ Пройдёте весь ETL целиком: Extract — получите данные из источника, Transform — очистите и преобразуете, Load — загрузите в базу;
➡️ Увидите классическую задачу дата-инженера через работающий код и конкретный результат;
➡️ Построите дашборды и посмотрите, какие выводы можно сделать из данных GitHub;
➡️ Поймёте, чем рабочий пайплайн отличается от кода в одном Jupyter Notebook, и как разбить обработку на отдельные скрипты.
Подойдёт и тем, кто хочет познакомиться с Data Engineering, и аналитикам, которым интересно научиться самостоятельно собирать данные для анализа.
🧑🏻💻 Спикер: Валерия Елпатьевская, инженер данных в Альфа-Банке, ментор курса Симулейтив «Инженер данных».
📆 Когда: 25 сентября, 19:00 МСК
➡️ Зарегистрироваться на вебинар
📈 Симулейтив | 📱 ВК | 📱 YouTube | 📱 Канал о DS
