AWS Compute Blog на русском
Подписаться
Проектирование на случай отказа: создание устойчивых систем на AWS
Узнайте, как предотвратить коррелированные сбои оборудования в распределенных системах на Amazon EC2. В этой статье рассматриваются реальные сценарии реагирования на инциденты, включая группы размещения разделов, составные сигналы тревоги, автоматическое восстановление с помощью Auto Scaling и лучшие практики наблюдаемости.