Прочитал статью CNCF о построении observability-платформы на OpenTelemetry и стеке LGTM.
https://www.cncf.io/blog/2025/12/16/how-to-build-a-cost-effective-observability-platform-with-opentelemetry/
В статье хорошо видно, что меняется сама управленческая модель эксплуатации ИТ.
Классическая схема
мониторинг - пороги - тикет
ориентирована на фиксацию уже произошедших отклонений. Она плохо масштабируется, требует ручной настройки и запаздывает относительно реальных проблем.
Современная схема выглядит иначе:
наблюдаемость - единая фабрика данных - прогнозирование событий.
Наблюдаемость рассматривается как источник структурированных данных о поведении системы. Логи, метрики и трассы собираются по стандарту OpenTelemetry и используются для аналитики и автоматизации.
В кейсе CNCF показано:
• переход на OpenTelemetry и стек Loki, Grafana, Tempo, Mimir;
• снижение совокупной стоимости observability примерно на 72%;
• полное покрытие всех сред, включая production и non-prod;
• отказ от vendor lock-in;
• архитектура, готовая к использованию AI для анализа и прогнозирования.
Думаю, что сейчас открывется окно возможностей для российских компаний по переходу на новую модель управления инфраструктурой.
Post #90
1.53K