Хороший доклад про отказоустойчивость крупной системы в контексте процессов и метрик. Денис Исаев расскажет историю о том, как они шли к текущей ситуации, какие этапы прошли и какие решения совершили.
⠀
Яндекс Go — это система из 800 микросервисов. Два года назад перед ними встала задача сильно вырастить аптайм всей системы.
⠀
Денис осветит основные челленджи и проекты, повлиявшие на улучшение аптайма. Покажет анализ ошибок и успешных решений. Даст краткий обзор подходов, избегая подробностей по каждому проекту. Предоставит ссылки для глубокого изучения ключевых аспектов, например, metastable failure state.
⠀
Встречаемся на DevOpsConf 2024 🙌
⠀
✅ Расписание конференции и билеты на сайте в описании канала @DevOpsConfChannel
Post #1045
691
