ClawMetry Guard

Ponha a IA a trabalhar. Mantenha o controlo.

Os agentes leem ficheiros, executam comandos e chamam serviços em seu nome. O Guard torna esse trabalho observável, verifica comportamentos de risco e fornece as evidências e os controlos para agir.

Avaliação de 7 dias. Sem cartão de crédito. Compatível com os agentes que já utiliza.

A visão

Os agentes de longa duração precisam de uma camada operacional.

Os agentes podem trabalhar durante horas com acesso a ficheiros, credenciais e serviços. Aplique disciplina operacional a esse trabalho: monitorização contínua, evidências comportamentais e uma forma de parar tudo quando algo corre mal. O Guard dá à sua equipa a visibilidade e os controlos para colocar mais autonomia a trabalhar.

"Tudo tem de ser auditável."

Satya Nadella · All-In · 15 September 2026 · 9:30
01 Capturar a atividade

Os seus agentes deixam um rasto. Nós tornamo-lo legível.

O Claude Code escreve JSONL. O Codex regista rollouts. O Cursor guarda dados de sessão locais em SQLite. O OpenClaw expõe registos e um gateway. O ClawMetry descobre estas fontes e utiliza um adaptador específico para cada runtime, lendo cada formato.

O coletor em segundo plano converte chamadas, resultados, utilização de modelos e timestamps em eventos tipados num repositório local DuckDB. Os identificadores de agente e de sessão ligam os registos. O painel e os detetores trabalham a partir desse mesmo histórico.

Claude CodeSessões JSONL
CodexRegistos de execução
CursorSQLite local
OpenClawLogs + gateway
Instale uma vez. Mantenha os agentes e o fluxo de trabalho existentes.
Explorar a arquitetura de recolha
Registo de sessão do runtime Exemplo simplificado

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

Adaptador de runtime → evento tipado → repositório local
Um evento estruturado DuckDB
Agente
Claude Code
Ferramenta
Leitura
Destino
~/.aws/credentials
Resultado
Ferramenta concluída
Contexto
Session + timestamp + tool call ID
02 Tornar o trabalho observável

Veja a sequência. Compreenda o comportamento.

O Guard transforma o histórico de eventos numa linha do tempo que pode investigar: quem agiu, qual ferramenta foi executada, o que tocou e o que aconteceu a seguir. Uma leitura de credenciais seguida de um pedido externo é uma sequência que pode ver e inspecionar.

Abaixo da linha do tempo, o Guard extrai a superfície de ação a partir dos argumentos registados das ferramentas: caminhos de ficheiros, padrões de comandos, hosts de destino e se um pedido lê ou escreve. Esses sinais tornam-se a entrada para as verificações comportamentais.

Os sinais sobre os quais os detetores podem raciocinar
Caminhos de ficheiroComandosHostsLeitura / escrita
  • Saiba qual agente e sessão agiram.
  • Veja as ferramentas, os argumentos e os resultados por ordem.
  • Abra as evidências por detrás de uma deteção.
Claude Code

Atividade da sessão

Sequência ilustrativa
  1. Ler ficheiros do projeto

    src/settings.py

  2. Ler um ficheiro de credenciais

    ~/.aws/credentials

  3. Chamar um host externo

    https://api.example.com

  4. Evidência comportamental registada

    Acesso a credenciais e atividade de rede numa única linha do tempo.

Atividade ilustrativa, ligada por agente, sessão e tempo. As deteções apontam de volta para os passos registados que as desencadearam.

03Executar os detetores

Dezasseis verificações. Seis formas de detetar problemas.

De uma execução em ciclo a um espaço de trabalho de risco ou a um padrão entre sessões, o Guard verifica as evidências com regras leves e explicáveis. Cada deteção indica o que correspondeu e porquê.

12verificações de sessão
3verificações de área de trabalho
1verificação entre sessões

Executa localmente. Sem juiz LLM separado.

O agente está a concluir a tarefa?

O que está a aceder ou a modificar?

O trabalho parou sem que ninguém tenha reparado?

Algo que foi lido está a tentar redirecionar o agente?

Este checkout pode executar código por conta própria?

Sessões independentes estão a fazer a mesma coisa incomum?

Calibrado para o trabalho. Claro quanto ao acionador.

O Guard começa com valores predefinidos, reconhece o vocabulário de ferramentas do runtime e adapta os limiares suportados a partir das sessões observadas dentro de limites definidos. A sua substituição tem precedência. As descobertas mostram a origem do limiar.

  1. Predefinições
  2. Perfil de execução
  3. Linha de base aprendida
  4. A sua substituição
04Priorize o incidente certo

Saiba o que precisa da sua atenção agora.

Um agente ocupado pode continuar a gastar sem fazer progressos. O Guard classifica as sessões pelo gasto estimado em risco e mantém o comportamento, a gravidade e os dados de suporte junto dessa estimativa.

Quando os dados de tempo e custo estão disponíveis, calcula o preço do trecho sinalizado com base na taxa de consumo observada da sessão. Abra a descoberta para ver a base de cálculo e o primeiro passo implicado.

Uma execução que começa a entrar em cicloExemplo ilustrativo
A fazer progressos
Chamadas de ferramentas repetidas
Primeiro passo implicado
Duração sinalizada
Taxa de consumo observada
Gasto estimado em risco

A estimativa cobre o trecho sinalizado, com limite no custo registado da sessão. A sua base fica visível no incidente.

05 Ligar evidências à ação

Você decide como o Guard responde.

Analise um incidente você mesmo, deixe uma política responder ou peça aprovação antes de uma ferramenta ser executada. Escolha o controlo que se adequa ao trabalho.

A

Alerta. Inspecione. Tome o controlo.

Leve uma descoberta à pessoa responsável. Analise o seu agente, sessão e evidências e use os controlos disponíveis de Pausar, Retomar, Parar ou Encerrar para intervir.

Incidente detetado Rever evidências Pausar · Retomar · Parar · Encerrar
Explorar controlos de sessão
B

Defina uma política para o Guard.

Escolha o sinal e a resposta com antecedência. Uma política pode pausar uma sessão em ciclo e encerrá-la ao fim de cinco minutos se a mesma condição continuar a corresponder.

Ciclo bloqueado detetado Pausar a sessão Após 5 minutos, se ainda corresponder Encerrar a sessão
Explorar políticas
C

Aprove a próxima ação.

O Claude Code, o Cursor e o GitHub Copilot CLI expõem hooks de pré-ferramenta. O Guard utiliza estes pontos de integração para verificar uma ação solicitada e permitir que a aprove ou rejeite antes da execução.

Pedido de ferramenta de runtime suportado Aguardar aprovação humana Aprovar ou rejeitar
Explorar portões de aprovação

Um único lugar para investigar e responder. A atividade registada alimenta a deteção e as políticas; as integrações de pré-ferramenta colocam a aprovação no momento em que uma ação está prestes a acontecer.

Os seus agentes. As suas evidências. O seu controlo.

Criado para um mundo de muitos agentes.

Escolha o melhor agente para cada tarefa. Mantenha um registo comum do seu trabalho e uma forma consistente de investigar e responder à medida que a sua equipa adiciona runtimes ou altera modelos.

Explorar o limite de dados

A sua escolha de agente

Use diferentes runtimes e modelos para diferentes tarefas. O Guard dá à atividade deles uma linguagem comum.

A sua evidência fica perto de si

A recolha e a deteção são executadas na sua máquina. Os snapshots detalhados na Cloud são encriptados no dispositivo e desencriptados no seu browser.

As suas decisões tornam-se política

Comece com visibilidade. Adicione os alertas, políticas e portas de aprovação que se adequam à forma como a sua equipa trabalha.

Ponha os seus agentes a trabalhar. Saiba quando intervir.

Instale o ClawMetry na máquina onde os seus agentes são executados. Abra o Guard, acompanhe uma sessão e inspecione a sua primeira descoberta.

O plano gratuito inclui OpenClaw, NVIDIA NemoClaw e Goose. Os planos pagos adicionam outros runtimes, portões de aprovação e políticas autónomas. O período de avaliação de 7 dias não requer cartão de crédito.

Começar na sua máquina
pip install clawmetry
clawmetry

Deteta automaticamente agentes suportados. Abra o separador Guard.

Aprofunde quando estiver pronto.

Como ativo os controlos para a minha configuração?

Comece por observar uma sessão e escolha os controlos adequados ao seu runtime. Uma nova política automática inicia em modo de monitorização para que possa inspecionar as suas decisões antes de ativar a ação.

A ação autónoma passa três bloqueios distintos: a política solicita uma ação, a máquina ativa a aplicação e o plano inclui-a. Defina CLAWMETRY_POLICY_ENFORCE=1 no nó para ativar a aplicação. O valor predefinido é 0. Cada passo de política é acionado no máximo uma vez por sessão, incluindo entre reinícios.

As sessões do Cursor CLI (cursor-agent) podem ser controladas individualmente. As conversações do editor Cursor partilham o processo do IDE, pelo que não têm controlos de processo separados.

No Windows, Pausar suspende o processo. Parar envia Ctrl+C, que afeta toda a consola. Encerrar fica disponível quando um processo não responde a Parar.

Para OpenClaw, use clawmetry proxy start para ativar uma pausa forçada. O Guard mostra os controlos disponíveis para a sessão.

O hook de aprovação do Claude Code falha de forma aberta se o dashboard local não puder ser alcançado, regressando aos prompts de permissão normais do Claude Code.

Consultar detalhes de configuração e controlo de processos
O que observam os detetores e como são avaliados?

Os detetores de comportamento inspecionam os argumentos e resultados de ferramenta registados. Identificam padrões para investigação; não são monitorização de syscalls do sistema operativo. A linha de tempo mostra as ações observadas, não o raciocínio oculto de um modelo.

Quando o custo não está disponível, o Guard assinala a sua base como desconhecida. A estimativa de gasto refere-se ao trecho sinalizado, não à sessão completa.

O nosso replay de fuga publicado inclui oito cenários: uma deteção limpa, duas descobertas úteis com etiqueta errada e cinco que não produziram nada. Duas dessas falhas foram posteriormente corrigidas. O scorecard regista os resultados e as lacunas restantes.

Consultar o scorecard de avaliação Ler a repetição entre sessões Consultar a documentação do Guard
Onde posso explorar a visão e ver o Guard demonstrado?

A conversa All-In de Satya Nadella a 15 de setembro de 2026 aborda a engenharia prática em torno do comportamento de agentes, evidências auditáveis e controlo humano. Trata-se de uma referência do setor, não de um endosso da ClawMetry.

Ver a conversa All-In completa

Participe em "A Kill Switch for AI Agents You Didn't Build", uma sessão online gratuita na sexta-feira, 2 de outubro de 2026, às 11:00 ET.

Reservar lugar