Иван выступит с докладом «Мониторинг SLO за 5 минут».
Иван — Tech Lead с бэкграундом во многих HighLoad-проектах по СНГ и Европе. Он работает на стыке бизнеса и ИТ: помогает клиентам внедрять облачные и on-prem технологии Yandex и переводить бизнес-задачи в эффективные технические решения.
Про SLO, SLI и Error Budget все читали ещё в той самой книге от Google про SRE. SLO-мониторинг помогает оценивать надежность сервиса относительно целевого уровня, а не реагировать на отдельные сбои.
За 5 минут Иван покажет практический пример настройки синтетического мониторинга веб-сервиса на основе Prometheus-экспортеров, расчета SLO на доступность и время отклика, сбора метрик в Yandex Monium.
Доклад будет полезен SRE, DevOps и разработчикам, которые отвечают за надежность сервисов.
Что будет в докладе:
⚪️ Зачем это бизнесу и ИТ: быстро вспомним, как SLO и Error Budget помогают приоритезировать разработку и объективно понимать, что происходит с сервисом
⚪️ С помощью Prometheus Blackbox Exporter и OpenTelemetry Collector настроим проверки доступности и измерение времени отклика
⚪️ Выведем формулы расчета SLO и Error Budget и настроим алертинг в Yandex Monium и Grafana
🎟 Покупайте билет на себя или компанию — мощная программа, полезный нетворкинг и буст ваших навыков гарантированы.
@devopsdayskz
