Сервис падает без причины, но в логах странные ошибки:
Too many open files
Resource temporarily unavailable
fork: retry
cannot allocate memory
Очень часто это не баг. Это лимиты ulimit.
▪️ Какие лимиты критичны
1️⃣ nofile - открытые файлы. Сколько файловых дескрипторов может открыть процесс.
Проверка:
ulimit -n
Или для конкретного процесса:
cat /proc/<PID>/limits | grep "Max open files"
Если видишь 1024, то для прод-сервиса это почти всегда мало.
2️⃣ nproc - количество процессов. Ограничение на число процессов пользователя.
Проверка:
ulimit -u
Или:
cat /proc/<PID>/limits | grep "Max processes"
Если приложение активно форкает воркеры - лимит может убить его.
▪️ Почему это сложно заметить
сервис стартует нормально
падает только под нагрузкой
в логах нет прямого указания на лимит
systemd может перезапускать бесконечно
▪️ Проверка лимитов у systemd-сервиса
systemctl show myservice | grep -E 'LimitNOFILE|LimitNPROC'
Если пусто, то используются дефолтные значения системы.
▪️ Как исправить. Создать override:
systemctl edit myservice
Добавить:
[Service]
LimitNOFILE=65535
LimitNPROC=4096
Перезагрузить:
systemctl daemon-reload
systemctl restart myservice
▪️ Быстрая диагностика падений. Если сервис падает под нагрузкой:
/proc/<PID>/limits
Посмотреть количество открытых файлов:
ls /proc/<PID>/fd | wc -l
Проверить количество процессов пользователя:
ps -u username | wc -l
BashTex 📱 #bash #check