ClawMetry Guard

讓 AI 投入工作,掌控權留在你手上。

代理人以您的名義讀取檔案、執行命令並呼叫服務。Guard 讓這些操作可觀測、檢查風險行為,並提供您採取行動所需的證據與控制項。

7 天試用,免信用卡。支援你已在使用的代理。

願景

長時間運行的代理人需要一個運維層。

代理人可存取檔案、憑證與服務,持續工作數小時。為這些工作引入運維紀律:持續監控、行為證據,以及在出現問題時介入的方式。Guard 為您的團隊提供可見性與控制項,讓更高程度的自主運作成為可能。

「一切都必須可稽核。」

Satya Nadella · All-In · 15 September 2026 · 9:30
01 擷取活動

代理會留下軌跡,我們讓它一目了然。

Claude Code 寫入 JSONL。Codex 記錄部署過程。Cursor 將本地 session 資料存於 SQLite。OpenClaw 公開日誌與 gateway。ClawMetry 發現這些來源,並使用特定執行環境的轉接器讀取每種格式。

背景收集器將呼叫、結果、模型用量與時間戳轉換為類型化事件,儲存於本地 DuckDB。代理人與 session ID 串連所有記錄。儀表板與偵測器均從同一份歷史資料運作。

Claude CodeJSONL sessions
Codex部署記錄
Cursor本地 SQLite
OpenClaw日誌 + gateway
安裝一次即可,保留你現有的代理與工作流程。
探索收集架構
執行環境工作階段記錄 簡化範例

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

執行環境轉接器 → 類型化事件 → 本地儲存
一筆結構化事件 DuckDB
代理
Claude Code
工具
Read
目標
~/.aws/credentials
結果
工具執行完成
情境
工作階段 + 時間戳記 + 工具呼叫 ID
02 讓工作可被觀察

看清順序,理解行為。

Guard 將事件歷史轉換為可供調查的時間軸:誰採取了行動、執行了哪個工具、涉及了什麼,以及後續發生了什麼。憑證讀取後緊接著外部請求,這樣的序列一目了然,可直接檢視。

在時間軸下方,Guard 從記錄的工具參數中擷取行動面:檔案路徑、命令模式、目標主機,以及請求是讀取還是寫入。這些訊號成為行為檢查的輸入。

偵測器可推理的訊號
檔案路徑命令主機讀取 / 寫入
  • 得知是哪個代理與工作階段採取了行動。
  • 依序查看工具、參數與結果。
  • 開啟發現背後的證據。
Claude Code

工作階段活動

示意順序
  1. 讀取專案檔案

    src/settings.py

  2. 讀取憑證檔案

    ~/.aws/credentials

  3. 呼叫外部主機

    https://api.example.com

  4. 已記錄行為證據

    憑證存取與網路活動呈現在同一條時間軸上。

示意性活動,依代理人、session 與時間串連。發現項目指向觸發它們的記錄步驟。

03執行偵測器

十六項檢查,六種發現問題的方式。

從循環執行到高風險工作區,或跨 session 的模式,Guard 以輕量、可解釋的規則檢查證據。每項發現都說明符合了什麼條件以及原因。

12session 檢查
3工作區檢查
1跨 session 檢查

本地執行,無需額外的 LLM 判斷器。

代理人正在完成任務嗎?

它正在存取或變更什麼?

工作是否已在無人察覺的情況下停止?

它讀取的內容是否試圖重定向它?

這個 checkout 能自行執行程式碼嗎?

獨立的 session 是否在做相同的異常行為?

根據工作校準,明確說明觸發條件。

Guard 從預設值出發,識別執行環境的工具詞彙,並在有限範圍內根據觀測到的 session 調整支援的閾值。您的覆寫設定優先生效,發現項目會顯示閾值來源。

  1. 預設值
  2. 執行環境配置
  3. 學習基準
  4. 您的覆寫
04優先處理正確的事件

掌握當下最需要關注的事項。

忙碌的代理人可能持續耗費成本卻毫無進展。Guard 依估計風險支出為 session 排序,並在估算旁保留行為、嚴重程度與支持證據。

當時間與成本資料可用時,系統使用 session 的觀測燃燒率為標記的時段定價。開啟發現項目可查看計算依據與最初涉及的步驟。

開始進入循環的執行示意範例
正在進行
重複的工具呼叫
最初涉及的步驟
標記時長
觀測燃燒率
估計風險支出

估算涵蓋標記的時段,上限為 session 的記錄成本。計算依據在事件中保持可見。

05 將證據連結到行動

由你決定 Guard 如何回應。

你可以親自審查事件、讓政策自動回應,或在工具執行前要求核准。選擇最適合工作的控制方式。

A

警示、檢查、接管控制。

將發現項目通知相關負責人。檢視其代理人、session 與證據,然後使用可用的暫停、繼續、停止或終止控制項進行介入。

偵測到事件 審查證據 暫停 · 繼續 · 停止 · 強制終止
探索工作階段控制
B

為 Guard 設定政策。

預先設定訊號與對應回應。一條策略可暫停循環中的 session,若五分鐘後相同條件仍符合,則將其終止。

偵測到陷入迴圈 暫停工作階段 5 分鐘後若仍符合條件 終止 session
探索政策
C

核准下一個動作。

Claude Code、Cursor 與 GitHub Copilot CLI 提供 pre-tool hooks。Guard 利用這些整合點在執行前檢查請求的操作,讓您核准或拒絕。

支援的執行環境工具請求 暫緩並等待人工核准 核准或拒絕
探索核准關卡

一個地方完成調查與回應。已記錄的活動驅動偵測與策略;pre-tool 整合讓核准發生在操作即將執行的時間點。

你的代理,你的證據,你的掌控。

為多代理並行的世界而打造。

為每項任務選擇最適合的代理人。隨著團隊新增執行環境或更換模型,保留統一的工作記錄與一致的調查回應方式。

探索資料邊界

您選擇的代理人

針對不同任務使用不同的執行環境與模型。Guard 為其活動提供共同語言。

您的證據就在身邊

收集與偵測在您的機器上執行。詳細的雲端快照在裝置上加密,在您的瀏覽器中解密。

您的決策成為策略

從可見性出發,逐步新增適合您團隊工作方式的警示、策略與核准關卡。

讓代理人投入工作,知道何時介入。

在代理執行的電腦上安裝 ClawMetry。開啟 Guard,追蹤一個工作階段,檢視你的第一項發現。

免費方案包含 OpenClaw、NVIDIA NemoClaw 與 Goose。付費方案另外加入其他執行環境、核准關卡與自主政策。7 天試用免信用卡。

在你的電腦上開始
pip install clawmetry
clawmetry

自動偵測支援的代理。開啟 Guard 分頁。

準備好了,再深入了解。

如何為我的環境啟用控制?

從觀測一個 session 開始,選擇適合其執行環境的控制項。新的自動策略以監控模式啟動,讓您在啟用行動前檢視其決策。

自主動作必須通過三道獨立的鎖:政策提出動作請求、機器已啟用強制執行,且方案包含此功能。在節點上設定 CLAWMETRY_POLICY_ENFORCE=1 即可啟用強制執行,預設值為 0。每個政策步驟在每個工作階段中最多觸發一次,重新啟動後亦同。

Cursor CLI(cursor-agent)的工作階段可個別控制。Cursor 編輯器中的對話共用 IDE 程序,因此沒有獨立的程序控制。

在 Windows 上,暫停會凍結程序;停止會送出 Ctrl+C,作用於整個主控台;當程序對停止沒有回應時,可使用強制終止。

若使用 OpenClaw,請執行 clawmetry proxy start 以啟用強制暫停。Guard 會顯示該工作階段可用的控制。

若無法連線到本機儀表板,Claude Code 核准 hook 會自動放行,回到 Claude Code 原本的權限提示。

閱讀設定與程序控制的詳細說明
偵測器觀察哪些內容?如何評估?

行為偵測器會檢查已記錄的工具參數與結果,找出值得調查的模式;它們並非作業系統層級的系統呼叫監控。時間軸顯示的是觀察到的動作,而非模型隱藏的推理過程。

無法取得成本時,Guard 會將其依據標示為未知。支出估算僅針對被標記的區段,而非整個工作階段。

我們公開的突破情境重播包含八個情境:一個成功攔截,兩個提出了有用發現但標籤錯誤,另外五個沒有產生任何結果。其中兩個遺漏之後已修正。評分表記錄了測試結果與尚待補足的缺口。

閱讀評估評分表 閱讀跨 session 重播 閱讀 Guard 文件
在哪裡可以深入了解願景並觀看 Guard 示範?

Satya Nadella 於 2026 年 9 月 15 日的 All-In 對談,描述了圍繞代理人行為、可稽核證據與人為控制的實務工程做法。此為業界參考資料,非 ClawMetry 的背書。

觀看 All-In 完整對談

歡迎參加「為非自建 AI 代理打造的緊急停止開關」免費線上講座,時間為 2026 年 10 月 2 日(星期五)美東時間 11:00。

預留座位