

Por CloudDog, Criado em 08/04/2026
Como montar um plano de Disaster Recovery na AWS: RTO e RPO na prática
Montar um plano de disaster recovery não é só escolher uma ferramenta de backup e confiar que vai funcionar quando precisar. É um processo estruturado, que começa entendendo o quanto a operação pode tolerar de indisponibilidade e de perda de dados, e termina com uma arquitetura testada de verdade. Este guia mostra os passos principais para montar esse plano na AWS.
O ponto de partida: RTO e RPO
Antes de escolher qualquer ferramenta, é preciso definir dois números para cada aplicação crítica da empresa.
O RTO, ou Recovery Time Objective, é o tempo máximo aceitável entre a falha e a operação voltar ao ar. Se o RTO de um sistema é de quatro horas, isso significa que a empresa consegue tolerar até quatro horas de indisponibilidade sem impacto grave no negócio.
O RPO, ou Recovery Point Objective, é a quantidade máxima de dados que a empresa pode perder, medida em tempo. Um RPO de quinze minutos significa que, no pior cenário, a empresa perde no máximo quinze minutos de dados desde o último ponto de recuperação.
Nem toda aplicação precisa do mesmo nível de proteção. Um sistema de e commerce que gera receita direta provavelmente precisa de RTO e RPO baixos, medidos em minutos. Um sistema interno de relatórios pode tolerar horas de indisponibilidade sem grande prejuízo.
As quatro estratégias de DR mais usadas na AWS
A AWS organiza as estratégias de disaster recovery em quatro categorias, ordenadas do custo mais baixo ao mais alto, e do RTO mais alto ao mais baixo.
- Backup and restore é a estratégia mais simples e barata. Os dados ficam armazenados de forma segura, geralmente com o AWS Backup, e a infraestrutura só é recriada quando o desastre acontece. O RTO costuma ser de horas.
- Pilot light mantém uma versão mínima e essencial da infraestrutura sempre ativa em uma região secundária, como o banco de dados replicado, enquanto o restante dos recursos é provisionado apenas quando necessário. O RTO cai para dezenas de minutos.
- Warm standby mantém uma versão reduzida, mas funcional, do ambiente completo rodando o tempo todo em uma segunda região. Em caso de falha, o ambiente é escalado rapidamente para suportar o tráfego total. O RTO fica na casa dos minutos.
- Multi site active active mantém o ambiente completo rodando simultaneamente em duas ou mais regiões, distribuindo o tráfego entre elas o tempo todo. É a estratégia com RTO mais próximo de zero, e também a mais cara de manter.
Ferramentas da AWS para colocar o plano em prática
O AWS Backup centraliza e automatiza a política de backup de diversos serviços, como EC2, RDS, EFS e DynamoDB, em um único painel, com regras de retenção e cópia entre regiões. O AWS Elastic Disaster Recovery, conhecido como DRS, replica servidores inteiros, incluindo os que rodam fora da AWS, para uma região de destino, permitindo failover em minutos sem precisar manter uma infraestrutura espelhada rodando o tempo todo. O Amazon S3 com replicação entre regiões protege dados armazenados em buckets contra a indisponibilidade de uma região inteira. O Amazon Route 53 com health checks e failover automático redireciona o tráfego para o ambiente de contingência assim que detecta que o ambiente principal está fora do ar.
Como escolher a estratégia certa?
A escolha depende de três fatores: quanto a aplicação vale para o negócio, qual o RTO e RPO que ela realmente exige, e qual orçamento está disponível para manter essa proteção. Aplicações críticas de receita costumam justificar warm standby ou multi site active active. Sistemas de suporte interno costumam ficar bem atendidos com backup and restore ou pilot light.
O plano só vale se for testado
Um plano de disaster recovery que nunca foi testado na prática é uma suposição, não uma garantia. Simulações periódicas de failover mostram se o RTO prometido é realmente alcançado, e evitam surpresas justamente no momento em que a empresa mais precisa que tudo funcione.
A CloudDog ajuda empresas a desenhar, implementar e testar estratégias de disaster recovery na AWS, com RTO e RPO definidos de acordo com a criticidade real de cada aplicação. Conheça nosso serviço de Backup e Disaster Recovery e fale com nossos arquitetos para descobrir qual estratégia faz sentido para o seu ambiente.
