ClawMetry Guard

AIに仕事を任せる。コントロールは手元に。

エージェントはファイルを読み取り、コマンドを実行し、あなたの代わりにサービスを呼び出します。Guardはその作業を可観測にし、危険な動作を検出し、対処するための証拠と制御手段を提供します。

7日間のトライアル。クレジットカード不要。お使いのエージェントでそのまま動作します。

ビジョン

長時間稼働するエージェントには、運用レイヤーが必要です。

エージェントはファイル、認証情報、サービスへのアクセスを持ちながら何時間も稼働できます。継続的なモニタリング、行動の証拠、問題発生時の停止手段など、運用の規律をその作業にもたらしましょう。Guardはチームに可視性と制御手段を提供し、より多くの自律性を活用できるようにします。

「すべては監査可能でなければならない。」

Satya Nadella · All-In · 15 September 2026 · 9:30
01 アクティビティを収集する

エージェントは痕跡を残す。それを読める形にします。

Claude CodeはJSONLを書き込みます。Codexはロールアウトを記録します。CursorはローカルのセッションデータをSQLiteに保存します。OpenClawはログとゲートウェイを公開します。ClawMetryはこれらのソースを検出し、ランタイム固有のアダプターを使用して各フォーマットを読み取ります。

バックグラウンドコレクターは、呼び出し、結果、モデルの使用状況、タイムスタンプをローカルのDuckDBストアの型付きイベントに変換します。エージェントIDとセッションIDがレコードを連結します。ダッシュボードと検出器は同じ履歴から動作します。

Claude CodeJSONLセッション
Codexロールアウト記録
CursorローカルSQLite
OpenClawログ + ゲートウェイ
インストールは一度だけ。既存のエージェントもワークフローもそのままです。
収集アーキテクチャを見る
ランタイムのセッションログ 簡略化した例

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

ランタイムアダプター → 型付きイベント → ローカルストア
1件の構造化イベント DuckDB
エージェント
Claude Code
ツール
Read
対象
~/.aws/credentials
結果
ツール完了
コンテキスト
セッション + タイムスタンプ + ツール呼び出しID
02 作業を観測可能にする

流れを見る。振る舞いを理解する。

Guardはイベント履歴を調査可能なタイムラインに変換します。誰が行動したか、どのツールが実行されたか、何に触れたか、次に何が起きたか。認証情報の読み取りに続く外部リクエストは、確認・検査できるシーケンスとして可視化されます。

タイムラインの下では、Guardが記録されたツール引数からアクションサーフェスを抽出します。ファイルパス、コマンドパターン、宛先ホスト、リクエストが読み取りか書き込みかを含みます。これらのシグナルが行動チェックへの入力となります。

検出器が推論できるシグナル
ファイルパスコマンドホスト読み取り / 書き込み
  • どのエージェントとセッションが動いたかを把握。
  • ツール、引数、結果を順番に確認。
  • 検出結果の根拠となる証拠を開く。
Claude Code

セッションアクティビティ

流れの例
  1. プロジェクトファイルを読み取り

    src/settings.py

  2. 認証情報ファイルを読み取り

    ~/.aws/credentials

  3. 外部ホストを呼び出し

    https://api.example.com

  4. 振る舞いの証拠を記録

    認証情報へのアクセスとネットワーク通信を1つのタイムラインで。

エージェント、セッション、時間で連結されたイラスト的なアクティビティ。検出結果はそれをトリガーした記録済みのステップに遡及します。

03検知器を実行する

16のチェック。問題を発見する6つの方法。

ループする実行、危険なワークスペース、セッションを跨ぐパターンまで、Guardは軽量で説明可能なルールで証拠を検証します。各検出結果は何がマッチしたか、その理由を示します。

12セッションチェック
3ワークスペースチェック
1セッション横断チェック

ローカルで実行。独立したLLMジャッジは不要。

エージェントはタスクを完了できていますか?

何にアクセスし、何を変更していますか?

誰にも気づかれずに作業が停止していませんか?

読み取ったものがエージェントをリダイレクトしようとしていませんか?

このチェックアウトは自身のコードを実行できますか?

独立したセッションが同じ異常な動作をしていませんか?

作業に合わせてキャリブレーション。トリガーは明確。

Guardはデフォルト値から始め、ランタイムのツール語彙を認識し、観測されたセッションから制限の範囲内でサポートされる閾値を適応させます。あなたのオーバーライドが優先されます。検出結果には閾値のソースが表示されます。

  1. デフォルト
  2. ランタイムプロファイル
  3. 学習済みベースライン
  4. あなたのオーバーライド
04重要なインシデントを優先する

今すぐ対応が必要なものを把握する。

忙しいエージェントは進捗なく費用を使い続ける可能性があります。Guardはリスクにさらされる推定費用でセッションをランク付けし、動作、重大度、裏付け証拠をその見積もりとともに表示します。

タイミングとコストデータが利用可能な場合、セッションの観測されたバーンレートを使用してフラグが立てられた区間を評価します。検出結果を開くと計算根拠と最初に関与したステップを確認できます。

ループし始めた実行例示
進捗中
繰り返すツール呼び出し
最初に関与したステップ
フラグ期間
観測されたバーンレート
リスクにさらされる推定費用

見積もりはフラグが立てられた区間をカバーし、セッションの記録されたコストを上限とします。その根拠はインシデントで常に表示されます。

05 証拠をアクションにつなげる

Guardの対応方法は、あなたが決める。

インシデントを自分で確認する、ポリシーに対応を任せる、ツールの実行前に承認を求める。作業に合ったコントロールを選べます。

A

アラート。検査。制御を取る。

検出結果を担当者に持ち込みます。エージェント、セッション、証拠をレビューし、利用可能なPause、Resume、Stop、Killコントロールを使って介入します。

インシデントを検知 証拠を確認 一時停止 · 再開 · 停止 · 強制終了
セッションコントロールを見る
B

Guardにポリシーを与える。

シグナルと対応をあらかじめ選択します。ポリシーはループするセッションを一時停止し、同じ条件が5分後もマッチする場合にそれを終了させることができます。

ループの停滞を検知 セッションを一時停止 5分後も一致が続く場合 セッションを終了する
ポリシーを見る
C

次のアクションを承認する。

Claude Code、Cursor、GitHub Copilot CLIはpre-toolフックを公開しています。Guardはこれらの統合ポイントを使用してリクエストされたアクションを検証し、実行前に承認または拒否できるようにします。

サポートされるランタイムツールリクエスト 人の承認まで保留 承認または拒否
承認ゲートを見る

調査と対応を一箇所で。記録されたアクティビティが検出とポリシーに入力され、pre-tool統合はアクションが実行される直前の時点で承認を行います。

あなたのエージェント。あなたの証拠。あなたのコントロール。

多数のエージェントが動く世界のために。

各ジョブに最適なエージェントを選択します。チームがランタイムを追加したりモデルを変更したりしても、作業の共通記録と一貫した調査・対応方法を維持します。

データの境界を見る

エージェントの選択

異なるジョブには異なるランタイムとモデルを使用します。Guardはそれらのアクティビティに共通言語を提供します。

証拠はあなたの手元に

収集と検出はあなたのマシンで実行されます。詳細なクラウドスナップショットはデバイスで暗号化され、ブラウザで復号されます。

あなたの判断がポリシーになる

まず可視性から始めます。チームの働き方に合ったアラート、ポリシー、承認ゲートを追加します。

エージェントを活用する。介入すべき時を把握する。

エージェントが動いているマシンにClawMetryをインストールしてください。Guardを開き、セッションを追い、最初の検出結果を確認しましょう。

無料プランにはOpenClaw、NVIDIA NemoClaw、Gooseが含まれます。有料プランでは、その他のランタイム、承認ゲート、自律ポリシーが追加されます。7日間のトライアルにクレジットカードは不要です。

あなたのマシンで始める
pip install clawmetry
clawmetry

対応エージェントを自動検出します。Guardタブを開いてください。

準備ができたら、さらに詳しく。

自分の環境でコントロールを有効にするには?

セッションを観察し、ランタイムに合ったコントロールを選択することから始めます。新しい自動ポリシーはモニターモードで開始されるので、アクションを有効にする前にその判断を検査できます。

自律アクションは3つの独立したロックを通過する必要があります。ポリシーがアクションを要求すること、マシンで強制実行が有効になっていること、プランに含まれていることです。強制実行を有効にするには、ノードでCLAWMETRY_POLICY_ENFORCE=1を設定します。デフォルトは0です。各ポリシーステップは、再起動をまたいでもセッションごとに最大1回しか発動しません。

Cursor CLI(cursor-agent)のセッションは個別にコントロールできます。Cursorエディターの会話はIDEのプロセスを共有するため、個別のプロセスコントロールはありません。

Windowsでは、一時停止はプロセスをサスペンドします。停止はCtrl+Cを送信し、コンソール全体に届きます。停止に応答しないプロセスには強制終了を使えます。

OpenClawでは、clawmetry proxy startを使うと強制的な一時停止を有効にできます。Guardはセッションで利用可能なコントロールを表示します。

Claude Codeの承認フックは、ローカルのダッシュボードに接続できない場合はフェイルオープンとなり、Claude Code標準の権限プロンプトに戻ります。

セットアップとプロセスコントロールの詳細を読む
検知器は何を観測し、どのように評価されているのか?

振る舞い検知器は、記録されたツールの引数と結果を調べます。調査のためにパターンを示すものであり、OSのシステムコール監視ではありません。タイムラインに表示されるのは観測された操作であり、モデルの内部の推論ではありません。

コストが取得できない場合、Guardはその算出根拠を不明と表示します。支出の推定はフラグが立った区間に関するもので、セッション全体ではありません。

公開しているブレイクアウトのリプレイには8つのシナリオがあります。正しく検知できたのが1件、有用な検出だがラベルが誤っていたのが2件、何も検出されなかったのが5件です。見逃しのうち2件はその後修正されました。スコアカードに結果と残る課題を記録しています。

評価スコアカードを読む セッション横断リプレイを読む Guardのドキュメントを読む
ビジョンの詳細やGuardのデモはどこで見られますか?

2026年9月15日のSatya NadellaのAll-In対談では、エージェントの動作、監査可能な証拠、人間による制御に関する実践的なエンジニアリングが説明されています。これは業界の参考資料であり、ClawMetryによる推薦ではありません。

All-Inの対談全編を見る

無料のオンラインセッション「A Kill Switch for AI Agents You Didn’t Build」に参加しませんか。2026年10月2日(金)11:00 ET開催です。

参加を申し込む