ClawMetry Guard

Metti l'IA al lavoro. Tienila sotto controllo.

Gli agenti leggono file, eseguono comandi e chiamano servizi per tuo conto. Guard rende tutto questo osservabile, rileva comportamenti rischiosi e ti fornisce le prove e i controlli necessari per agire.

Prova di 7 giorni. Nessuna carta di credito. Funziona con gli agenti che già usi.

La visione

Gli agenti a lunga esecuzione hanno bisogno di un livello operativo.

Gli agenti possono lavorare per ore con accesso a file, credenziali e servizi. Porta disciplina operativa a questo lavoro: monitoraggio continuo, prove comportamentali e un modo per fermare tutto quando qualcosa va storto. Guard offre al tuo team la visibilità e i controlli per mettere a frutto una maggiore autonomia.

"Tutto deve essere verificabile."

Satya Nadella · All-In · 15 September 2026 · 9:30
01 Acquisisci l'attività

I tuoi agenti lasciano una traccia. Noi la rendiamo leggibile.

Claude Code scrive in JSONL. Codex registra i rollout. Cursor conserva i dati di sessione locali in SQLite. OpenClaw espone log e un gateway. ClawMetry individua queste sorgenti e utilizza un adattatore specifico per runtime per leggere ciascun formato.

Il collettore in background trasforma chiamate, risultati, utilizzo del modello e timestamp in eventi tipizzati in un archivio DuckDB locale. Gli ID agente e sessione collegano i record. La dashboard e i rilevatori operano sulla stessa cronologia.

Claude CodeSessioni JSONL
CodexRecord di Rollout
CursorSQLite locale
OpenClawLog + gateway
Installa una volta. Mantieni gli agenti e il flusso di lavoro esistenti.
Esplora l'architettura di raccolta
Log di sessione del runtime Esempio semplificato

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

Adattatore runtime → evento tipizzato → archivio locale
Un evento strutturato DuckDB
Agente
Claude Code
Strumento
Read
Destinazione
~/.aws/credentials
Risultato
Strumento completato
Contesto
Session + timestamp + tool call ID
02 Rendi il lavoro osservabile

Vedi la sequenza. Comprendi il comportamento.

Guard trasforma la cronologia degli eventi in una timeline che puoi esaminare: chi ha agito, quale strumento ha eseguito, cosa ha toccato e cosa è successo dopo. Una lettura di credenziali seguita da una richiesta esterna è una sequenza che puoi vedere e ispezionare.

Sotto la timeline, Guard estrae la superficie d'azione dagli argomenti degli strumenti registrati: percorsi di file, pattern di comandi, host di destinazione e se una richiesta legge o scrive. Questi segnali diventano l'input per i controlli comportamentali.

I segnali su cui i rilevatori possono ragionare
Percorsi fileComandiHostLettura / scrittura
  • Identifica quale agente e sessione hanno agito.
  • Visualizza strumenti, argomenti e risultati in ordine.
  • Apri le prove dietro un rilevamento.
Claude Code

Attività di sessione

Sequenza illustrativa
  1. Lettura dei file di progetto

    src/settings.py

  2. Lettura di un file di credenziali

    ~/.aws/credentials

  3. Chiamata a un host esterno

    https://api.example.com

  4. Prove comportamentali registrate

    Accesso alle credenziali e attività di rete in un'unica timeline.

Attività illustrativa, collegata per agente, sessione e tempo. I rilevamenti rimandano ai passaggi registrati che li hanno attivati.

03Esegui i rilevatori

Sedici controlli. Sei modi per individuare i problemi.

Da un'esecuzione in loop a uno spazio di lavoro rischioso o a un pattern tra sessioni, Guard verifica le prove con regole leggere e trasparenti. Ogni rilevamento indica cosa ha corrisposto e perché.

12controlli di sessione
3controlli del workspace
1controllo trasversale alle sessioni

Esegue localmente. Nessun giudice LLM separato.

L'agente sta portando a termine il lavoro?

A cosa sta accedendo o cosa sta modificando?

Il lavoro si è fermato senza che nessuno se ne accorgesse?

Qualcosa che ha letto sta cercando di reindirizzarlo?

Questo checkout può eseguire codice autonomamente?

Sessioni indipendenti stanno eseguendo la stessa azione anomala?

Calibrato sul lavoro. Chiaro sul trigger.

Guard parte dalle impostazioni predefinite, riconosce il vocabolario degli strumenti del runtime e adatta le soglie supportate dalle sessioni osservate entro limiti definiti. Le tue sovrascritture hanno la precedenza. I risultati mostrano la fonte della soglia.

  1. Predefiniti
  2. Profilo di runtime
  3. Baseline appresa
  4. La tua impostazione
04Gestisci prima l'incidente giusto

Scopri subito cosa richiede la tua attenzione.

Un agente molto attivo può continuare a spendere senza fare progressi. Guard classifica le sessioni in base alla spesa stimata a rischio e affianca a quella stima il comportamento, la gravità e le prove a supporto.

Quando i dati di tempistica e costo sono disponibili, calcola il costo del tratto segnalato usando il tasso di consumo osservato della sessione. Apri il rilevamento per vedere la base del calcolo e il primo passo coinvolto.

Un'esecuzione che inizia a ciclareEsempio illustrativo
Progressi in corso
Chiamate agli strumenti ripetute
Primo passo coinvolto
Durata segnalata
Tasso di consumo osservato
Spesa stimata a rischio

La stima copre il tratto segnalato, con un tetto pari al costo registrato della sessione. La sua base rimane visibile nell'incidente.

05 Collega le prove all'azione

Sei tu a decidere come risponde Guard.

Esamina un incidente di persona, lascia che una policy risponda, oppure richiedi un'approvazione prima che uno strumento venga eseguito. Scegli il controllo più adatto al lavoro.

A

Avvisa. Analizza. Prendi il controllo.

Porta un risultato alla persona responsabile. Esamina agente, sessione e prove, quindi utilizza i controlli disponibili Pausa, Riprendi, Stop o Kill per intervenire.

Incidente rilevato Esamina le prove Pausa · Riprendi · Stop · Kill
Esplora i controlli di sessione
B

Assegna una policy a Guard.

Scegli il segnale e la risposta in anticipo. Una policy può mettere in pausa una sessione in loop, quindi terminarla dopo cinque minuti se la stessa condizione è ancora verificata.

Loop bloccato rilevato Metti in pausa la sessione Dopo 5 minuti, se ancora verificata Termina la sessione
Esplora le policy
C

Approva la prossima azione.

Claude Code, Cursor e GitHub Copilot CLI espongono hook pre-strumento. Guard utilizza questi punti di integrazione per verificare un'azione richiesta e consentirti di approvarla o negarla prima dell'esecuzione.

Richiesta strumento runtime supportata In attesa di approvazione umana Approva o nega
Esplora i gate di approvazione

Un unico luogo per indagare e rispondere. L'attività registrata alimenta il rilevamento e le policy; le integrazioni pre-strumento portano l'approvazione nel momento in cui un'azione sta per essere eseguita.

I tuoi agenti. Le tue prove. Il tuo controllo.

Progettato per un mondo di molti agenti.

Scegli l'agente migliore per ogni compito. Mantieni un registro comune del suo lavoro e un metodo coerente per indagare e rispondere, man mano che il team aggiunge runtime o cambia modelli.

Esplora il confine dei dati

La tua scelta di agente

Usa runtime e modelli diversi per compiti diversi. Guard offre alla loro attività un linguaggio comune.

Le tue prove restano vicine a te

La raccolta e il rilevamento avvengono sul tuo dispositivo. Gli snapshot Cloud dettagliati sono cifrati sul dispositivo e decifrati nel tuo browser.

Le tue decisioni diventano policy

Inizia con la visibilità. Aggiungi gli avvisi, le policy e i gate di approvazione adatti al modo in cui lavora il tuo team.

Metti al lavoro i tuoi agenti. Sappi quando intervenire.

Installa ClawMetry sulla macchina in cui girano i tuoi agenti. Apri Guard, segui una sessione e analizza il tuo primo risultato.

Il piano gratuito include OpenClaw, NVIDIA NemoClaw e Goose. I piani a pagamento aggiungono altri runtime, gate di approvazione e policy autonome. La prova di 7 giorni non richiede carta di credito.

Inizia sulla tua macchina
pip install clawmetry
clawmetry

Rileva automaticamente gli agenti supportati. Apri la scheda Guard.

Approfondisci quando sei pronto.

Come si abilitano i controlli per la mia configurazione?

Inizia osservando una sessione e scegliendo i controlli adatti al suo runtime. Una nuova policy automatica parte in modalità monitor, così puoi esaminare le sue decisioni prima di abilitare le azioni.

L'azione autonoma supera tre blocchi distinti: la policy richiede un'azione, la macchina abilita l'applicazione e il piano la include. Imposta CLAWMETRY_POLICY_ENFORCE=1 sul nodo per abilitare l'applicazione. Il valore predefinito è 0. Ogni passaggio della policy si attiva al massimo una volta per sessione, anche attraverso i riavvii.

Le sessioni Cursor CLI (cursor-agent) possono essere controllate singolarmente. Le conversazioni nell'editor Cursor condividono il processo IDE, quindi non dispongono di controlli di processo separati.

Su Windows, Pausa sospende il processo. Stop invia Ctrl+C, che raggiunge l'intera console. Kill è disponibile quando un processo non risponde a Stop.

Per OpenClaw, usa clawmetry proxy start per abilitare una pausa forzata. Guard mostra i controlli disponibili per la sessione.

L'hook di approvazione di Claude Code fallisce in modo aperto se il dashboard locale non è raggiungibile, tornando ai normali prompt di autorizzazione di Claude Code.

Leggi i dettagli su configurazione e controlli di processo
Cosa osservano i rilevatori e come vengono valutati?

I rilevatori di comportamento esaminano gli argomenti e i risultati degli strumenti registrati. Evidenziano pattern per l'indagine; non si tratta di monitoraggio syscall del sistema operativo. La timeline mostra le azioni osservate, non il ragionamento nascosto di un modello.

Quando il costo non è disponibile, Guard contrassegna la sua base come sconosciuta. La stima della spesa riguarda il tratto segnalato, non l'intera sessione.

Il nostro replay di breakout pubblicato include otto scenari: un rilevamento corretto, due risultati utili con etichetta errata e cinque che non hanno prodotto nulla. Due di queste mancanze sono state successivamente corrette. La scorecard registra i risultati e i gap rimanenti.

Leggi la scorecard di valutazione Leggi il replay trasversale alle sessioni Leggi la documentazione di Guard
Dove posso esplorare la visione e vedere Guard in azione?

La conversazione All-In di Satya Nadella del 15 settembre 2026 descrive l'ingegneria pratica attorno al comportamento degli agenti, alle prove verificabili e al controllo umano. Si tratta di un riferimento di settore, non di un'approvazione da parte di ClawMetry.

Guarda la conversazione All-In completa

Partecipa a "A Kill Switch for AI Agents You Didn't Build", una sessione online gratuita venerdì 2 ottobre 2026 alle 11:00 ET.

Prenota un posto