В производственном кейсе Grafana Labs шлюз в Kubernetes рассчитали на 17 млн активных временных рядов и по 1 ТБ логов и трассировок в сутки. Заложили около 195 ГБ памяти и 28 ядер CPU: 33–35 подов по 6 ГиБ.
Ingress распределяет трафик, лимита CPU у подов нет, а HPA держит 30–100 реплик с целями 70% CPU и 90% памяти. Перед запуском шлюз нагружали telemetrygen и собственной сборкой k6.
Метрики
/metrics отправляли в Grafana Cloud отдельным путём, чтобы перегруженный Alloy не скрыл своё состояние. Добавьте запас памяти и проведите нагрузочный тест: публичный расчёт не изолирует сценарий приёма и повторной отправки метрик.
