Все мониторят поды, но почти никто не следит за этим критически важным компонентом
А потом в Kubernetes-кластере что-то ломается – и внезапно etcd становится самым важным компонентом всей инфраструктуры.
Потому что etcd – это мозг Kubernetes.
Каждый Deployment, Secret, ConfigMap и Node хранится в etcd в виде данных.
И вот что многие понимают неправильно:
Только API Server взаимодействует с etcd напрямую.
Поэтому если с etcd возникают проблемы, кластер перестаёт принимать любые новые изменения. Вы не сможете ничего задеплоить, масштабировать или обновить.
Даже сейчас многие инженеры допускают базовые ошибки при работе с etcd.
Не делают регулярные бэкапы. Запускают etcd на том же диске, где находится ОС. Или игнорируют проблемы с latency в распределённых конфигурациях.
В продакшене etcd должен работать на быстрых SSD и быть изолирован от других workloads. Бэкапы должны выполняться автоматически.
В подробном гайде разобрали бэкап и восстановление etcd
Читать: https://devopscube.com/backup-etcd-restore-kubernetes/
👉 DevOps Portal
Post #2044
2.79K

- ❤ 10
- 👍 3
- 🔥 1