Biblioteca de detectoresReinicializações repetidas

Reinicializações repetidas

De volta online. E de volta outra vez.

Identifique uma sessão que fica reiniciando.

Veja o problema. Entenda o achado.

Narração em inglês com legendas.

Como isso passa despercebido

O agente volta online, então tudo parece bem. Depois ele começa de novo. Reinicializações repetidas podem se esconder por trás de um processo que parece saudável sempre que você olha para ele.

Uma tarefa inacabada sobrevive na sua lista de afazeres enquanto o runtime continua reiniciando. Sem a sequência de eventos da sessão, cada reinicialização parece um novo começo. Juntos, eles sugerem um problema de confiabilidade que merece investigação.

O que o ClawMetry detecta

ClawMetry conta os inícios e reinicializações de sessão registrados dentro de uma janela delimitada. Quando acumulam o suficiente, ele levanta um alerta de reinicialização repetida. A evidência inclui a contagem e se a comparação usou timestamps ou a janela de eventos.

A diferença que muda o achado

Exemplo que aciona o detector

2 inícios em um minuto

Alerta de aviso

Comparação silenciosa

Um único início

Nenhum achado para este detector.

O exemplo verificado registra dois inícios com um minuto de intervalo e gera um aviso. Um único início permanece silencioso. A janela de reinicialização padrão é quinze minutos, e o alerta reporta o limite usado para essa avaliação.

Inspecionar o resultado do detector
{
  "kind": "crashed",
  "severity": "warning",
  "evidence": {
    "restarts": 2,
    "threshold": 2,
    "window_sec": 900,
    "threshold_source": "static",
    "observed": "session.started/restarted events counted by timestamps",
    "span_sec": 60
  }
}
Baixar entradas e resultados completos (JSON)
Como o exemplo foi verificado

Estes exemplos avaliam o detector publicado com dados de eventos criados ou arquivos de configuração descartáveis. Os vídeos ilustram esses comportamentos. Não são gravações de agentes reais ou da interface do produto. Nenhum comando nos exemplos foi executado.

O resultado estabelece o comportamento para essas entradas. Não estabelece ingestão em tempo real, prevenção ou um comprometimento real. Inspecionar o contrato de fonte fixado.

O que verificar a seguir

Verifique os logs do runtime para razões de saída e erros de inicialização. Observe a pressão de recursos e a última ação antes da reinicialização. Após resolver a causa, confirme que o agente permanece em execução e retorna à tarefa original.

  1. Leia os logs de saída do runtime
  2. Inspecione a ação anterior
  3. Confirme que a sessão permanece ativa

O que este sinal estabelece

Eventos de início repetidos são um sinal de confiabilidade. Eles não provam a causa de uma falha, e uma reinicialização intencional pode contribuir para a contagem.

Mantenha os momentos importantes visíveis.

Acompanhe a atividade do agente, inspecione os achados e decida o que precisa da sua atenção.