Я тут микроскопом забиваю гвозди на проектах, которые навайбкодил, и решил разобраться в инструментах работы с данными в широком смысле: техническими, продуктовыми и бизнесовыми.
Впереди серия постов, комментарии экспертов приветствуются!
Observability (наблюдаемость системы) помогает понять, что происходит внутри IT-системы и почему: мониторить ее в обычное время и расследовать, что пошло не так при инциденте.
Термин пришел в IT из теории управления observability означает возможность определить внутреннее состояние системы по ее внешним сигналам. Термин формализовал математик Рудольф Кальман в 1960-х. Позже идея перекочевала в эксплуатацию сложных программных систем.
Monitoring отвечает «всё ли работает?», observability помогает разобраться «а что именно произошло?»
Обычно выделяют три основных типа телеметрии:
Metrics - числа во времени: запросы, ошибки, задержки
Logs - записи о конкретных событиях и ошибках
Traces - путь конкретного запроса через сервисы
А Grafana и Prometheus... уже инструменты внутри observability, о них в следующем посте.
❤️ знаю, что метрики и логи это разное
😈 не поднимался тот сервис, который не падал
#pm #product #cловарикпродакта #observability
