Темы разные: DevOps практики и опыт коллег, очень большой трек по анализу данных и применении AI для этих задач, вопросы информационной безопасности, разработка внутренних продуктов для оптимизации процессов и даже вопросы индустриальной маркировки.
🖥 Мы традиционно представляли направление мониторинга.
В этот раз затронули тему симптомо-ориентированного подхода в мониторинге. Впервые с этой концепцией я познакомился читая не безызвестную книгу. Отдельная, но небольшая глава, как раз посвящена этой теме. Она поднимает вопросы конкуренции подходов "что сломалось" и "почему сломалось".
Одним из ключевых профитов подхода при контроле симтомов является снижение так называемого
alerts fatigue или, по-другому, усталость от алертов. Вы снижаете шум от фолс-позитив и контролируете только то, что действительно влияет на пользовательский опыт. В результате, вы получаете здоровый алертинг, требующий настоящей реакции на каждое уведомление.Мониторинг причин при этом никуда не пропадает и не удаляется, но основная рекомендация - это уводить отображение причин на качественные панели дашбордов, где подготовленный инженер по инструкции (да, они должны быть, как ни крути) может быстро найти все нужные ему параметры.
Это эволюция и тренд, который всё чаще применяется в крупных компаниях и не беспочвенно, т.к. подход хорошо масштабируется при росте ифраструктуры и количества серверов, сервисов и систем.
Приложу ещё одну ссылку на материал Паши Юрьева по теме. Мы в своих системах уже давно перешли на "уровни критичности" и, по моему скромному мнению, это реально полезное разделение.
Изучайте, развивайтесь и выбирайте подходы, которые подойдут лучше к вашим типам задач!
