Когда дашбордов уже недостаточно — переходишь на уровень ОС.
Вот 10 команд, которые используются во время продакшен-инцидентов:
1.
strace -p <PID> -cТрейсит системные вызовы запущенного процесса с агрегированной статистикой. Помогает понять, чего он ждёт.
2.
perf top -p <PID>Живой CPU-профайлинг процесса.
Мгновенно показывает «горячие» функции.
3.
tcpdump -i eth0 -w capture.pcap port 8080Сниффинг трафика на порту 8080.
Глубокая отладка сети.
4.
ab -n 10000 -c 100 http://localhost/Нагрузочное тестирование через Apache Bench.
10k запросов, 100 одновременных.
5.
kubectl debug node/node1 -it --image=busyboxПодключение ephemeral-контейнера для отладки ноды.
6.
dmesg -T | grep -i 'oom'Проверка OOM-событий (killer) в ядре с таймстемпами.
7.
lsof -i :8080Показывает, какой процесс занимает порт 8080.
8.
iostat -xz 1 5Статистика дискового I/O каждую секунду (5 итераций).
9.
vmstat -w 1 5Метрики памяти, swap и CPU в реальном времени.
10.
kubectl debug pod/app -it --copy-to=debug-pod --image=nicolaka/netshootГлубокая сетевая отладка с использованием netshoot toolbox.
✈️ Linux Ninja
