Pular para o conteúdo principal

Observabilidade dos destinos

O CentralOps mostra, em tempo real, como cada destino está recebendo os seus eventos: quantos eventos por segundo saem, quanto tempo levam para chegar, quantos foram rejeitados e quantos estão aguardando reenvio. Tudo isso aparece direto na interface, sem precisar de ferramenta externa.

Quando usar

  • Um destino parou de receber eventos. Você percebe que o SIEM externo está "vazio" e quer confirmar se o problema é no CentralOps (envio caiu) ou no destino. Abra a saúde do destino e veja a taxa de envio e o último envio bem-sucedido.
  • Latência subindo / fila crescendo. Durante um pico de alertas, você quer saber se os eventos estão atrasando ou empilhando na fila de reenvio antes que alguém reclame.
  • Validar uma mudança de roteamento. Depois de alterar uma regra de roteamento, você confere quantos eventos estão de fato caindo em cada destino e se as rejeições aumentaram.

Onde olhar na interface

O que você quer verOnde encontrar
Visão consolidada de todos os destinos e do funil de eventosmenu Visão geral -> Dashboard
Saúde detalhada de um destino específico (EPS, latência, rejeições, fila)menu Roteia -> Destinos (apenas admin)
Como os eventos estão sendo distribuídos entre destinosmenu Roteia -> Fluxo de dados (apenas admin)
Saúde do processamento que normaliza os eventos antes do enviomenu Visão geral -> Saúde do pipeline
observação

As telas Destinos, Rotas e Fluxo de dados só aparecem para usuários administradores. Operadores de SOC acompanham a saúde geral pelo Dashboard e pela Saúde do pipeline.


O que cada número significa

Ao abrir a saúde de um destino, você verá um conjunto de indicadores. Use esta tabela como referência rápida:

IndicadorO que medeQuando se preocupar
EPS (eventos por segundo)Ritmo atual de envio ao destino (janelas de 1, 5 e 60 min)Caiu para zero sem motivo, ou despencou em relação ao normal
Enviados na última horaTotal de eventos aceitos pelo destinoMuito abaixo do esperado para o volume da operação
RejeitadosEventos recusados pelo destino (autenticação, tamanho ou formato)Subindo de forma contínua
Latência médiaTempo entre o evento sair do CentralOps e ser aceito pelo destinoAcima do normal por períodos longos
Fila de reenvioEventos que falharam e estão aguardando nova tentativaCrescendo sem parar (indica destino com problema)
Estado do destinoSe o destino está saudável ou sob proteção contra destino instávelSinalizado como instável / bloqueado
Último envio bem-sucedidoQuando o destino recebeu o último evento com sucessoMuito tempo atrás enquanto há eventos chegando

Termos que aparecem na tela

  • EPS — eventos por segundo. É a medida principal de "quanto está fluindo agora".
  • Fila de reenvio — quando um destino recusa ou está indisponível, os eventos não são descartados: vão para uma fila e o CentralOps tenta enviar de novo automaticamente.
  • Proteção contra destino instável — se um destino começa a falhar muito, o CentralOps para de bombardeá-lo por um tempo e tenta de novo mais tarde, para não perder eventos nem sobrecarregar o destino. Quando isso acontece, o destino aparece marcado nessa condição.
  • Rejeitados — diferente de "fila de reenvio". Rejeitado é quando o destino respondeu recusando o evento (por exemplo, credencial inválida ou evento grande demais). Esses casos normalmente exigem ajuste de configuração do destino.

Acompanhando os eventos recentes de um destino

Na tela de um destino, além dos números agregados, você pode inspecionar os últimos eventos despachados para conferir o conteúdo que está saindo. Os dados sensíveis (tokens, senhas) aparecem mascarados — você nunca vê uma credencial em texto puro.

Use isso para confirmar, por exemplo, que os eventos certos estão indo para o destino certo depois de uma mudança de roteamento.


Quando agir

Sintoma na telaProvável causaPróximo passo na interface
EPS em zero, mas há eventos chegandoDestino indisponível ou credencial expiradaAbra Roteia -> Destinos, verifique o estado e o último erro do destino
Rejeições subindoFormato/tamanho/credencial do destinoReveja a configuração do destino em Roteia -> Destinos
Fila de reenvio crescendoDestino instável ou fora do arAguarde a recuperação automática; se persistir, acione o destino. Você pode reprocessar a fila de reenvio na tela de Destinos quando o destino voltar
Latência alta de forma contínuaDestino lento ou rede congestionadaConfirme com o time responsável pelo destino
Eventos não normalizam (não chegam a sair)Problema antes do envioVerifique Visão geral -> Saúde do pipeline e Normaliza -> Quarentena
dica

Antes de concluir que o CentralOps deixou de enviar, confira o Último envio bem-sucedido e a fila de reenvio. Fila crescendo + EPS caindo quase sempre significa problema no destino, não no CentralOps.


Monitoramento avançado de infraestrutura

Além dos painéis de produto que você vê na interface, o CentralOps pode exportar métricas e registros técnicos para ferramentas de monitoramento de infraestrutura usadas pelo time de TI/SRE (por exemplo, painéis corporativos de observabilidade). Isso serve para a equipe de operações acompanhar a plataforma em nível de servidor, não para o uso diário do operador de SOC.

Essa exportação é definida pela equipe de infraestrutura no momento do deploy. Se precisar habilitá-la ou direcioná-la para uma ferramenta específica, fale com o administrador da plataforma. Para o trabalho do dia a dia, tudo que você precisa já está nas telas de Dashboard, Destinos e Saúde do pipeline.


Próximos passos

  • Conferir onde os eventos estão indo: menu Roteia -> Fluxo de dados (apenas admin).
  • Eventos que não normalizaram: veja Quarentena.
  • Saúde geral da plataforma: menu Visão geral -> Dashboard.