В Kubernetes-продакшене вы замечаете, что Pod периодически убивается и перезапускается, при этом в kubectl describe pod видно событие OOMKilled. Как будете диагностировать и устранять проблему?
Проверю метрики памяти Pod’а (kubectl top pod, Prometheus), проанализирую requests/limits, логи приложения и профилировку на предмет утечек. Если приложение действительно потребляет больше памяти — оптимизирую код или увеличу лимиты. Если лимиты выставлены неправильно — подкорректирую их. Для критичных сервисов настрою HPA/VPA, чтобы они масштабировались под нагрузкой.
Библиотека собеса по DevOps
Post #780
740