Dois eixos complementares

A documentação separa a saúde do ambiente computacional da situação dos processos de integração.

EixoO que observaPergunta respondida
AmbienteCPU, memória, disco, rede e disponibilidade dos componentesA plataforma tem recursos e está acessível?
ConectoresExecuções, documentos, sucesso, falhas e atrasoOs dados estão sendo integrados corretamente?
AplicaçãoLatência, respostas HTTP e errosO serviço entrega o comportamento esperado?
NegócioVolume e defasagem dos registrosA informação necessária chegou no tempo adequado?

Sinais úteis

Um painel isolado não explica a causa; métricas e logs precisam ser lidos em conjunto.

  • Disponibilidade e latência das APIs críticas.
  • Taxa de sucesso e erro por conector, hospital e tipo de documento.
  • Tempo desde o último processamento bem-sucedido.
  • Tamanho da fila ou conjunto pendente, quando aplicável.
  • Uso de CPU, memória, disco e conexões.
  • Correlação entre extração, envio, persistência e consulta.

Ciclo de resposta

O plano de comunicação consultado pode ser organizado como uma sequência operacional.

  1. 1
    Detectar

    Confirmar o alerta com mais de um sinal e delimitar o início.

  2. 2
    Classificar

    Avaliar impacto, alcance, criticidade e presença de dado sensível.

  3. 3
    Conter

    Reduzir o impacto sem apagar evidências necessárias.

  4. 4
    Comunicar

    Acionar os responsáveis pelo canal institucional e atualizar o estado.

  5. 5
    Recuperar

    Restabelecer, validar dados pendentes e monitorar estabilidade.

  6. 6
    Aprender

    Registrar causa, linha do tempo, ações e prevenção.

Comunicação útil

A mensagem deve permitir decisão sem divulgar informação desnecessária.

Modelo de atualização
Estado: investigando | identificado | monitorando | resolvido
Início percebido: [data e hora]
Impacto: [serviço e público afetados, sem dado pessoal]
Alcance: [ambientes/origens afetados]
Ação atual: [contenção ou recuperação]
Próxima atualização: [data e hora]
Referência interna: [ID do incidente]