🖥🧱 Почему это повторяется? Как мы расследуем Root Cause в чужой инфраструктуре
Сервис восстановили, тикет закрыли, а через неделю — тот же сбой. Знакомо?
🛠 Когда однотипные инциденты перестают быть случайностью, пора подключать problem management. Команда проводит Root Cause Analysis: ищет первопричину сбоя, определяет владельца проблемы и решает, что с ней делать дальше.
Найти root cause — только половина работы. После расследования есть несколько сценариев:
🟢 Устранить проблему своими силами
🟢 Передать ее владельцу продукта
🟢 Оформить запрос на изменение
🟢 Запустить проект модернизации
🟢 Зафиксировать known error и осознанно принять риск
➡️В новой статье на Хабр руководитель центра экспертизы по комплексному сервису К2Тех Наталия Сляднева рассказывает, как устроен problem management на аутсорсе, почему подрядчику невыгодны постоянные инциденты и как понять, что поддержка устраняет причины, а не только восстанавливает сервис. Внутри — реальные кейсы с разными финалами.
📺 Наш канал в MAX
Post #2263
313

- 🔥 3
- 👍 2
- 👏 2