Сегодня поговорим про мониторинг и логи в облаке
Золотое правило девопса: о падении сервиса в первую очередь должен узнавать DevOps, а не пользователь.
Поэтому старайтесь создавать «сложные» алерты, чтобы они ловили всплески ошибок, задержек и нагрузок. И, по-хорошему, собирайте метрики и логи через единый сервис — без зоопарка агентов и форматов.
Кстати про логи: старайтесь держать их централизованно в облачном сервисе или хранилище хотя бы 90 дней. Добавьте визуализацию и автоматизацию. Пусть система сама масштабируется или откатывает сервис, пока вы спокойно пьёте кофе.
Может создать какой-нибудь чек-лист по настройке алертов? Нужен вам такой?
👍 — делаем, делаем
🌚— предложу свой вариант в комментариях
#DevOps #мониторинг #автоматизация #IT
Post #26
184
- 👍 9
- 🔥 2