As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
Detecção
É importante saber o mais rápido possível que suas cargas de trabalho não estão fornecendo os resultados comerciais que deveriam oferecer. Dessa forma, você pode declarar rapidamente um desastre e se recuperar de um incidente. Para objetivos agressivos de recuperação, esse tempo de resposta, juntamente com as informações apropriadas, é fundamental para atingir os objetivos de recuperação. Se seu objetivo de tempo de recuperação for de uma hora, você precisará detectar o incidente, notificar a equipe apropriada, engajar seus processos de escalonamento, avaliar as informações (se houver) sobre o tempo esperado de recuperação (sem executar o plano de DR), declarar um desastre e se recuperar em uma hora.
nota
Se as partes interessadas decidirem não invocar a DR, mesmo que o RTO esteja em risco, reavalie os planos e objetivos da DR. A decisão de não invocar os planos de DR pode ser porque os planos são inadequados ou há falta de confiança na execução.
É fundamental considerar a detecção, notificação, escalonamento, descoberta e declaração de incidentes em seu planejamento e objetivos para fornecer objetivos realistas e alcançáveis que forneçam valor comercial.
A AWS publica nossa maioria das up-to-the-minute informações sobre disponibilidade de serviços no Service Health Dashboard
AWS Health Dashboard
Para os requisitos de RTO mais rigorosos, você pode implementar o failover automatizado com base em verificações de integridade.