Alta disponibilidade
Alta disponibilidade é projetar o ambiente para que a falha de uma peça não pare a operação, eliminando o ponto único de falha. Não é o mesmo que backup: uma protege contra parada, a outra contra perda.
O exercício que revela a necessidade é simples: liste cada componente e pergunte o que acontece se ele sumir agora. Servidor, banco, link, energia. Onde a resposta for "a operação para", existe um ponto único de falha.
Eliminar cada um custa dinheiro, e é por isso que a decisão precisa vir do negócio. Manter uma segunda instância pronta praticamente dobra o custo daquela camada, e faz sentido para o sistema que sustenta faturamento, não para todos.
Uma distinção importante: alta disponibilidade não protege contra erro. Se alguém apaga a tabela errada, a réplica apaga junto, no mesmo segundo. Se um ataque cifra os arquivos, a réplica é cifrada também. Para esses casos o que salva é backup, e de preferência desconectado.
As duas coisas resolvem problemas diferentes e nenhuma substitui a outra. Alta disponibilidade cuida de parada; backup cuida de perda e de corrupção.
Quando se aplica
- A operação para de faturar quando o sistema cai, e isso já aconteceu.
- Existe componente sem par: um servidor, um link, um banco.
- Há compromisso de disponibilidade com cliente em contrato.
- A janela de manutenção virou problema porque não há como atualizar sem parar.
Quando não se aplica
- A operação tolera algumas horas fora do ar sem prejuízo relevante.
- Como substituto de backup. Réplica copia o erro junto, e na mesma hora.
- Antes de existir monitoramento. Redundância sem alguém percebendo que uma metade caiu só adia a parada.
Arquitetura sem ponto único de falha, dimensionada pelo que a operação exige.
Termos relacionados
A pergunta que mapeia o risco: o que para se esta peça sumir agora?
O diagnóstico levanta os pontos únicos de falha e separa o que vale duplicar do que aceita janela.
Agendar diagnóstico
