3 часа ночи, у вас красный дашборд, неделю назад вы дропнули user_id в угоду оптимизации хранения данных, но запросы все равно отрабатывают жутко медленно. Идентификаторы типа container_id, customer_tenant_id, request_trace_id, user_id, feature_flag_version или commit_sha — не просто метрики. Это важные параметры, необходимые для отладки сложных систем.
Несколько очевидных стратегий:
— не собирайте метрики слишком часто (не чаще, чем они могут поменяться)
— дропайте ненужные лейблы
— выполняйте агрегации (до записи в бэкэнд)
Один из способов выполнения агрегаций — это использование stream aggregation в vmagent от VictoriaMetrics. В этом видео кофаундер VM Роман Хавроненко рассказывает как это работает. Это не единственный способ агрегации. Похожий функционал есть и в других инструментах, например, OTEL Collector.
📌 Подробнее: https://www.youtube.com/watch?v=WUo_7rT8ZQ4
MemOps 🤨
