В кейсе Percona PostgreSQL-реплика отставала, хотя FSx использовал около половины выделенной пропускной способности. Проверка самого хранилища не объясняла задержку.
vmstat показал процессы, ожидающие I/O, а nfsiostat — значительное время в очереди. Дальше выяснилось: NFS работал через одно TCP-соединение, которое упиралось в ограничение EC2 на отдельный поток. Общие лимиты экземпляра и файловой системы оставались недостигнутыми.После включения
nconnect=16 клиент сообщил, что отставание начало сокращаться. Авторы подчёркивают: это число не универсально, его нужно подбирать нагрузочным тестом.Разбор Percona показывает порядок расследования. При похожем сбое проверяйте весь путь I/O: клиент, соединения, сеть и сервер хранилища.