⭐️⭐️ В высоконагруженных системах сотни сервисов общаются друг с другом каждую секунду, и любой простой напрямую влияет на бизнес. Когда latency внезапно вырастает в 5 раз, а алерт приходит среди ночи — хочется не гадать, а точно понимать, что произошло и почему.
Максим Коробов, Go-разработчик, в новой статье на Хабре рассказывает:
⏹️Чем monitoring отличается от observability — и почему Prometheus ≠ решение всех проблем;
⏹️USE, RED и 4 Golden Signals — что реально работает в продуктовых командах;
⏹️Как правильно считать latency (и почему среднее значение вас обманывает);
⏹️Как настроить трейсинг через OpenTelemetry и увидеть полный execution path запроса;
⏹️Какие ошибки чаще всего убивают observability (кардинальность метрик, избыточные трейсы, перегруженные хранилища)
В статье — практическая реализация на Go: Prometheus, Grafana, OpenTelemetry, slog, реальные примеры кода и запросов в PromQL.
➡️ Читать на Хабре
Post #727
5.56K

- 👍 30
- 🔥 18
- ❤ 16
- 🤩 1