Метрики масштабирования в Kubernetes
Всем привет!
(Автоматическое) масштабирование – крайне интересная тема. На первый взгляд она кажется достаточно простой. Но лишь на первый, пока не начнутся вопросы.
Масштабироваться реактивно? Проактивно? Как долго оставлять «неиспользуемые» ресурсы? Как контролировать масштабирование, чтобы оно не вышло из-под контроля?..
Автор статьи предлагает рассмотреть 5 метрик, которые могут помочь сделать процесс контролируемым.
Среди них:
🍭 Committed capacity percentage. То, насколько используются существующие мощности
🍭 Error rates. Что происходит в момент масштабирования?
🍭 Mean Time to First Byte (MTFB). Как много проходит времени с момента принятия решения о масштабировании до выполнения полезной работы сервисом, ресурсы которого масштабируются?
🍭 Application disruption. Влияет ли масштабирование на нарушение работоспособности запущенных приложений
🍭 Application churn. Что происходит, если средство масштабирования определяет потребность в 2,5 реплики, но такого быть не может?
По мнению Автора, отслеживание этих метрик может помочь оптимизировать процесс (автоматического) масштабирования.
Увы, статья детально не раскрывает каждую метрику в отдельности… Но! Автор собирается сделать это в отдельных статьях.
Помимо самих метрик в материале очень много интересных рассуждений на тему оптимального использования ресурсов.
Рекомендуем!
Post #1577
706