Как искать узкие места сервера методом USE
Метод USE предлагает начинать диагностику со списка ресурсов: CPU, памяти, сети, накопителей, контроллеров и шин. Для каждого проверьте три сигнала: долю времени за работой, очередь задач, которые ресурс не успевает обслужить, и ошибки.
Составьте чеклист с конкретной командой или метрикой напротив каждого пункта. Начните с CPU, свободной памяти, дискового ввода-вывода и сети. Если узкое место не найдено, переходите к контроллерам и шинам между CPU, памятью и устройствами.
Не доверяйте длинным средним: в примере автора пятиминутное окно скрывало скачки загрузки CPU до 100%, хотя мониторинг не показывал больше 80%. Проверяйте и ошибки с успешными повторами: они могут снижать производительность незаметно. Определения метрик и чеклисты для разных ОС собраны на сайте Брендана Грегга.
Post #7980
217