Dois eixos complementares
A documentação separa a saúde do ambiente computacional da situação dos processos de integração.
| Eixo | O que observa | Pergunta respondida |
|---|---|---|
| Ambiente | CPU, memória, disco, rede e disponibilidade dos componentes | A plataforma tem recursos e está acessível? |
| Conectores | Execuções, documentos, sucesso, falhas e atraso | Os dados estão sendo integrados corretamente? |
| Aplicação | Latência, respostas HTTP e erros | O serviço entrega o comportamento esperado? |
| Negócio | Volume e defasagem dos registros | A informação necessária chegou no tempo adequado? |
Sinais úteis
Um painel isolado não explica a causa; métricas e logs precisam ser lidos em conjunto.
- Disponibilidade e latência das APIs críticas.
- Taxa de sucesso e erro por conector, hospital e tipo de documento.
- Tempo desde o último processamento bem-sucedido.
- Tamanho da fila ou conjunto pendente, quando aplicável.
- Uso de CPU, memória, disco e conexões.
- Correlação entre extração, envio, persistência e consulta.
Ciclo de resposta
O plano de comunicação consultado pode ser organizado como uma sequência operacional.
- 1Detectar
Confirmar o alerta com mais de um sinal e delimitar o início.
- 2Classificar
Avaliar impacto, alcance, criticidade e presença de dado sensível.
- 3Conter
Reduzir o impacto sem apagar evidências necessárias.
- 4Comunicar
Acionar os responsáveis pelo canal institucional e atualizar o estado.
- 5Recuperar
Restabelecer, validar dados pendentes e monitorar estabilidade.
- 6Aprender
Registrar causa, linha do tempo, ações e prevenção.
Comunicação útil
A mensagem deve permitir decisão sem divulgar informação desnecessária.
Estado: investigando | identificado | monitorando | resolvido
Início percebido: [data e hora]
Impacto: [serviço e público afetados, sem dado pessoal]
Alcance: [ambientes/origens afetados]
Ação atual: [contenção ou recuperação]
Próxima atualização: [data e hora]
Referência interna: [ID do incidente]