Cómo pasa desapercibido
Una compilación falla. El agente lo intenta de nuevo. Falla otra vez. Cada reintento agrega más salida, pero el problema de fondo sigue ahí. Si solo verificas si la sesión está activa, puedes pasar por alto el fallo que sigue repitiéndose.
Considera un agente preparando un cambio mientras su herramienta de shell sigue devolviendo un error. La causa podría ser una dependencia faltante, un comando inválido o acceso no disponible. La pregunta útil es qué herramienta sigue fallando y con qué frecuencia.
Qué detecta ClawMetry
ClawMetry cuenta los errores atribuidos a la misma herramienta en la ventana de eventos. Cuando el conteo supera el umbral aplicable, genera una advertencia de fallo repetido de herramienta. El hallazgo nombra la herramienta, el conteo de fallos y el umbral utilizado.
La diferencia que cambia el hallazgo
Ejemplo que activa el detector
4 errores de Bash
Hallazgo de advertencia
Comparación sin hallazgo
1 error de Bash
Sin hallazgo para este detector.
En el ejemplo verificado, cuatro resultados fallidos del shell generan una advertencia. Un solo fallo queda por debajo del umbral. Esto es diferente a un bucle de llamadas idénticas: los comandos pueden cambiar mientras la misma herramienta sigue devolviendo errores.
Inspeccionar el resultado del detector
{
"kind": "repeated_tool_failure",
"severity": "warning",
"evidence": {
"tool": "Bash",
"failures": 4,
"threshold": 3,
"threshold_source": "static"
}
}Descargar entradas y resultados completos (JSON)Cómo se verificó el ejemplo
Estos ejemplos evalúan el detector publicado con datos de eventos creados o archivos de configuración desechables. Los videos ilustran esos comportamientos. No son grabaciones de agentes en uso ni de la interfaz del producto. Ningún comando de los ejemplos fue ejecutado.
El resultado establece el comportamiento para estas entradas. No establece ingesta en tiempo real, prevención ni un compromiso real. Inspeccionar el contrato de código fuente fijado.
Qué revisar a continuación
Abre los resultados fallidos y busca la causa común. Corrige el entorno o el problema de acceso, o reduce el alcance de la tarea del agente antes de permitir que los reintentos se acumulen. Luego verifica que el siguiente resultado de la herramienta realmente tenga éxito.
- Leer los resultados de error
- Corregir la causa común
- Verificar el siguiente resultado
Qué establece esta señal
Esta es una señal de confiabilidad. No diagnostica la causa raíz ni prueba que el agente esté bajo ataque.