Disponibilidade é uma propriedade do sistema
Servidor, rede, energia, identidade, aplicações, fornecedores e pessoas formam uma única cadeia de serviço. Um componente pode estar saudável enquanto o serviço permanece indisponível.
Por isso, a análise deve começar pelos serviços essenciais e caminhar para trás: quais recursos são necessários, quais dependências são compartilhadas e quanto tempo a organização pode operar sem cada uma delas?
- Energia e refrigeração
- Rede e acesso à internet
- Identidade e autenticação
- Computação e armazenamento
- Backup e recuperação
- Pessoas e fornecedores
- Documentação e comunicação
1–3: pontos únicos, capacidade e obsolescência
O primeiro risco é o ponto único de falha: um link, equipamento, credencial ou especialista cuja indisponibilidade interrompe o todo. O segundo é operar constantemente no limite, sem margem para picos, falhas ou manutenção. O terceiro é manter componentes fora de suporte, com reposição incerta ou correções indisponíveis.
Redundância real exige caminhos independentes e testes. Dois equipamentos conectados ao mesmo circuito, ao mesmo provedor ou à mesma configuração incorreta podem falhar juntos.
4–5: backup sem restauração e dependências não mapeadas
Backup não é sinônimo de recuperação. Cópias precisam de proteção, retenção, isolamento adequado e testes de restauração que comprovem tempo e integridade. O RPO define quanto dado pode ser perdido; o RTO, quanto tempo o serviço pode permanecer indisponível.
Dependências invisíveis surgem quando uma aplicação depende de DNS, diretório, certificado, API externa ou pessoa-chave e isso não está documentado. Mapas de serviço e runbooks reduzem o tempo gasto descobrindo o ambiente durante a crise.
6–7: mudanças frágeis e resposta improvisada
Mudanças sem avaliação de impacto, janela, validação e retorno planejado transformam manutenção em incidente. Já uma resposta improvisada amplia o dano: contatos desatualizados, decisões sem autoridade definida e comunicação inconsistente consomem minutos críticos.
Um plano útil define papéis, gatilhos, canais alternativos, ordem de recuperação e critérios de encerramento. Ele deve ser exercitado, não apenas arquivado.
Transforme risco em um plano priorizado
Registre cada risco com ativo ou serviço afetado, probabilidade, impacto, controle atual, responsável e prazo. Priorize o que combina alto impacto e baixa capacidade de recuperação.
Use o ciclo Governar, Identificar, Proteger, Detectar, Responder e Recuperar do NIST CSF 2.0 como linguagem comum entre liderança e equipe técnica. O framework organiza resultados; a implementação deve refletir o contexto da organização.
Aplicação prática
Teste de prontidão operacional
Se uma resposta for incerta, ela já indica um item de trabalho:
Referências técnicas relacionadas
Links externos para fontes oficiais. A consulta deve considerar a versão vigente e o contexto da sua organização.
Conteúdo informativo. Não substitui avaliação técnica, jurídica ou regulatória específica.