Как за 10 мин найти причину инцидента и перейти к его устранению
Когда бизнес-сервис деградирует, проблема может быть в приложении, инфраструктуре, сети, базе данных или Kubernetes-кластере. Если метрики, логи, трассировки приложения и данные по инфраструктуре находятся в разных системах, на устранение инцидента может уйти много времени — сначала придется собрать контекст.
На вебинаре 17 июля расскажем, как Deckhouse Observability Platform (DOP) помогает объединить данные по инфраструктуре и приложениям, понять зависимость между компонентами и быстрее пройти путь от алерта до устранения инцидента.
В программе:
• Новые возможности DOP: APM, распределённый веб-мониторинг, инцидент-менеджмент, SLA/SLO-дашборды и отчёты о доступности веб-сайтов.
• Разбор задач эксплуатации и инфраструктурных команд: как быстрее находить причины сбоев и снижать риск пропустить критический инцидент.
• Демо: развёртывание мониторинга с получением первых данных «из коробки» без ручной настройки, разбор сценария «алерт → локализация → первопричина».
Спикер: Владимир Гурьянов, технический директор продукта Deckhouse Observability Platform
➝ Регистрируйтесь и подключайтесь 17 июля в 12.00.
Post #478
186

- 🔥 3
- 👍 1
- 🤔 1