Como isso passa despercebido
Uma build falha. O agente tenta novamente. Falha de novo. Cada nova tentativa adiciona mais saída, mas o problema subjacente ainda está lá. Se você verificar apenas se a sessão está ativa, pode perder a falha que continua se repetindo.
Considere um agente preparando uma mudança enquanto sua ferramenta de shell retorna repetidamente um erro. A causa pode ser uma dependência ausente, um comando inválido ou acesso indisponível. A pergunta útil é qual ferramenta continua falhando e com que frequência.
O que o ClawMetry detecta
O ClawMetry conta os erros atribuídos à mesma ferramenta na janela de eventos. Quando a contagem ultrapassa o limite aplicável, ele emite um aviso de falha repetida de ferramenta. O achado nomeia a ferramenta, a contagem de falhas e o limite usado.
A diferença que muda o achado
Exemplo que aciona o detector
4 erros do Bash
Aviso detectado
Comparação silenciosa
1 erro do Bash
Nenhum achado para este detector.
No exemplo verificado, quatro resultados de shell com falha geram um aviso. Uma única falha fica abaixo do limite. Isso é diferente de um loop de chamada idêntica: os comandos podem mudar enquanto a mesma ferramenta continua retornando erros.
Inspecionar o resultado do detector
{
"kind": "repeated_tool_failure",
"severity": "warning",
"evidence": {
"tool": "Bash",
"failures": 4,
"threshold": 3,
"threshold_source": "static"
}
}Baixar entradas e resultados completos (JSON)Como o exemplo foi verificado
Estes exemplos avaliam o detector publicado com dados de eventos criados ou arquivos de configuração descartáveis. Os vídeos ilustram esses comportamentos. Não são gravações de agentes reais ou da interface do produto. Nenhum comando nos exemplos foi executado.
O resultado estabelece o comportamento para essas entradas. Não estabelece ingestão em tempo real, prevenção ou um comprometimento real. Inspecionar o contrato de fonte fixado.
O que verificar a seguir
Abra os resultados com falha e procure a causa comum. Corrija o ambiente ou o problema de acesso, ou restrinja a tarefa do agente antes de permitir que as tentativas se acumulem. Em seguida, verifique se o próximo resultado da ferramenta realmente tem sucesso.
- Leia os resultados de erro
- Corrija a causa raiz comum
- Verifique o próximo resultado
O que este sinal estabelece
Este é um sinal de confiabilidade. Ele não diagnostica a causa raiz nem prova que o agente está sob ataque.