Biblioteca de detectoresFallo repetido de herramienta

Fallo repetido de herramienta

La misma herramienta. Otro fallo.

Encuentra el paso fallido que los reintentos siguen enterrando.

Ve el problema. Entiende el hallazgo.

Narración en inglés con subtítulos.

Cómo pasa desapercibido

Una compilación falla. El agente lo intenta de nuevo. Falla otra vez. Cada reintento añade más salida, pero el problema subyacente sigue ahí. Si solo verificas si la sesión está activa, puedes pasar por alto el fallo que sigue repitiéndose.

Considera un agente preparando un cambio mientras su herramienta de shell devuelve repetidamente un error. La causa podría ser una dependencia faltante, un comando inválido o acceso no disponible. La pregunta útil es qué herramienta sigue fallando y con qué frecuencia.

Qué detecta ClawMetry

ClawMetry cuenta los errores atribuidos a la misma herramienta en la ventana de eventos. Cuando el conteo supera el umbral aplicable, genera una advertencia de fallo repetido de herramienta. El hallazgo nombra la herramienta, el conteo de fallos y el umbral utilizado.

La diferencia que cambia el hallazgo

Ejemplo que activa el detector

4 errores de Bash

Hallazgo de advertencia

Comparación sin hallazgo

1 error de Bash

Sin hallazgo para este detector.

En el ejemplo verificado, cuatro resultados de shell fallidos generan una advertencia. Un solo fallo se mantiene por debajo del umbral. Esto es diferente a un bucle de llamadas idénticas: los comandos pueden cambiar mientras la misma herramienta sigue devolviendo errores.

Inspeccionar el resultado del detector
{
  "kind": "repeated_tool_failure",
  "severity": "warning",
  "evidence": {
    "tool": "Bash",
    "failures": 4,
    "threshold": 3,
    "threshold_source": "static"
  }
}
Descargar entradas y resultados completos (JSON)
Cómo se verificó el ejemplo

Estos ejemplos evalúan el detector publicado con datos de eventos elaborados o archivos de configuración desechables. Los videos ilustran esos comportamientos. No son grabaciones de agentes en vivo ni de la interfaz del producto. Ningún comando de los ejemplos fue ejecutado.

El resultado establece el comportamiento para estas entradas. No establece la ingesta en tiempo de ejecución, la prevención ni un compromiso real. Inspeccionar el contrato de fuente fijado.

Qué revisar a continuación

Abre los resultados fallidos y busca la causa común. Corrige el problema de entorno o acceso, o acota la tarea del agente antes de dejar que se acumulen los reintentos. Luego verifica que el siguiente resultado de la herramienta realmente tenga éxito.

  1. Leer los resultados de error
  2. Corregir la causa común
  3. Verificar el siguiente resultado

Qué establece esta señal

Esta es una señal de fiabilidad. No diagnostica la causa raíz ni prueba que el agente esté bajo ataque.

Mantén visibles los momentos importantes.

Sigue la actividad del agente, inspecciona hallazgos y decide qué necesita tu atención.