Максим Качинский, Head of Ops в Rocketdata и эксперт комьюнити Практики FinOps, разобрал KEDA как production-инструмент для workloads с непостоянной нагрузкой.
В статье не только про scale-to-zero. Внутри есть конфиги, сценарии и проверки перед раскаткой:
🟣очереди RabbitMQ, Kafka, SQS;
🟣cron scaler для dev/staging и сервисов с рабочими часами
🟣Prometheus scaler для RPS, latency и custom-метрик
🟣HTTP Add-on для кратких пиков трафика
🟣maxReplicaCount как технический лимит и финансовый гардрейл
🟣cold start, flapping, downstream-лимиты, алерты, rollback plan и troubleshooting
Главная ценность материала в том, что KEDA рассматривается не как «поставили автоскейлер и сэкономили», а как инженерный механизм, который нужно проверять через пилот: pod-hours, cost-метрики, SLA, latency, ошибки и поведение scale up / scale down.
Полезно DevOps, SRE, platform-инженерам и всем, кто отвечает за Kubernetes-инфраструктуру и хочет снижать холостой простой без ручного scale и bash-скриптов.
📝 Читать статью на Хабр по ссылке
💬 Практики FinOps
