Google Cloud показал standby buffers для GKE. Идея в том, чтобы держать подготовленные, но suspended-ноды: они уже прошли init, DaemonSet'ы и preload, но не жгут полный compute как обычный запас.
Для кластеров со всплесками это замена balloon pods и ручному overprovisioning. Standby-ноды возобновляются в 2-3 раза быстрее, чем создаётся свежая нода, а buffer описывается через
CapacityBuffer. В статье есть YAML-пример и проверка через kubectl get nodes с condition Suspended.Если у вас latency SLO страдает именно на scale-up, это стоит тестировать на отдельном node pool.
