AWS DNS outage: когда падает облако
Сегодняшний сбой в AWS напомнил, насколько уязвимы даже крупнейшие облака.
Из-за сбоя во внутреннем DNS регион us-east-1 потерял связь между сервисами.
DynamoDB стала недоступна - и это вызвало цепную реакцию: EC2 не запускала инстансы, Lambda - функции, SQS - сообщения.
Пострадали Snapchat, Reddit, Venmo, Robinhood, Coinbase, Alexa и другие.
AWS устранила DNS-проблему, но восстановление сервисов шло часами.
Что важно учесть:
Не держите всё в одном регионе - используйте Cross-Region Replication и Route 53 failover.
DNS - не мелочь. Настройте локальные кэши и fallback-резолверы.
Мультиоблачность снижает риски: дублируйте критичные сервисы в GCP/Azure/on-prem.
Failover должен быть автоматическим, иначе это не отказоустойчивость.
Тестируйте Disaster Recovery-планы регулярно - «падение региона» реально.
Upd: кажется, часть сервисов AWS сами были завязаны на us-east-1 и отвалились глобально. И клиенты уже не могли никак застраховаться от такого
Post #22
2.5K

- ❤ 18
- 👍 6