Biblioteca de detectoresFalha repetida de ferramenta

Falha repetida de ferramenta

A mesma ferramenta. Outra falha.

Encontre a etapa com falha que as tentativas continuam enterrando.

Veja o problema. Entenda o achado.

Narração em inglês com legendas.

Como isso passa despercebido

Uma build falha. O agente tenta novamente. Falha de novo. Cada nova tentativa adiciona mais saída, mas o problema subjacente ainda está lá. Se você verificar apenas se a sessão está ativa, pode perder a falha que continua se repetindo.

Considere um agente preparando uma mudança enquanto sua ferramenta de shell retorna repetidamente um erro. A causa pode ser uma dependência ausente, um comando inválido ou acesso indisponível. A pergunta útil é qual ferramenta continua falhando e com que frequência.

O que o ClawMetry detecta

O ClawMetry conta os erros atribuídos à mesma ferramenta na janela de eventos. Quando a contagem ultrapassa o limite aplicável, ele emite um aviso de falha repetida de ferramenta. O achado nomeia a ferramenta, a contagem de falhas e o limite usado.

A diferença que muda o achado

Exemplo que aciona o detector

4 erros do Bash

Aviso detectado

Comparação silenciosa

1 erro do Bash

Nenhum achado para este detector.

No exemplo verificado, quatro resultados de shell com falha geram um aviso. Uma única falha fica abaixo do limite. Isso é diferente de um loop de chamada idêntica: os comandos podem mudar enquanto a mesma ferramenta continua retornando erros.

Inspecionar o resultado do detector
{
  "kind": "repeated_tool_failure",
  "severity": "warning",
  "evidence": {
    "tool": "Bash",
    "failures": 4,
    "threshold": 3,
    "threshold_source": "static"
  }
}
Baixar entradas e resultados completos (JSON)
Como o exemplo foi verificado

Estes exemplos avaliam o detector publicado com dados de eventos criados ou arquivos de configuração descartáveis. Os vídeos ilustram esses comportamentos. Não são gravações de agentes reais ou da interface do produto. Nenhum comando nos exemplos foi executado.

O resultado estabelece o comportamento para essas entradas. Não estabelece ingestão em tempo real, prevenção ou um comprometimento real. Inspecionar o contrato de fonte fixado.

O que verificar a seguir

Abra os resultados com falha e procure a causa comum. Corrija o ambiente ou o problema de acesso, ou restrinja a tarefa do agente antes de permitir que as tentativas se acumulem. Em seguida, verifique se o próximo resultado da ferramenta realmente tem sucesso.

  1. Leia os resultados de erro
  2. Corrija a causa raiz comum
  3. Verifique o próximo resultado

O que este sinal estabelece

Este é um sinal de confiabilidade. Ele não diagnostica a causa raiz nem prova que o agente está sob ataque.

Mantenha os momentos importantes visíveis.

Acompanhe a atividade do agente, inspecione os achados e decida o que precisa da sua atenção.