ClawMetry Guard

Để AI làm việc. Giữ mọi thứ trong tầm kiểm soát của bạn.

Agent đọc tệp, chạy lệnh và gọi dịch vụ thay mặt bạn. Guard giúp công việc đó trở nên minh bạch, kiểm tra hành vi rủi ro, đồng thời cung cấp bằng chứng và công cụ để bạn hành động.

Dùng thử 7 ngày. Không cần thẻ tín dụng. Tương thích với các agent bạn đang dùng.

Tầm nhìn

Agent chạy dài cần một tầng vận hành.

Agent có thể hoạt động hàng giờ với quyền truy cập vào tệp, thông tin xác thực và dịch vụ. Hãy đưa kỷ luật vận hành vào công việc đó: giám sát liên tục, bằng chứng hành vi và khả năng dừng mọi thứ khi có sự cố. Guard mang lại cho nhóm của bạn khả năng hiển thị và công cụ kiểm soát để triển khai nhiều quyền tự chủ hơn.

"Mọi thứ đều phải có thể kiểm toán."

Satya Nadella · All-In · 15 September 2026 · 9:30
01 Thu thập hoạt động

Agent của bạn để lại dấu vết. Chúng tôi làm cho nó dễ đọc.

Claude Code ghi JSONL. Codex lưu rollout. Cursor lưu dữ liệu phiên cục bộ trong SQLite. OpenClaw cung cấp log và một gateway. ClawMetry tìm các nguồn này và dùng adapter theo runtime để đọc từng định dạng.

Trình thu thập nền chuyển các lệnh gọi, kết quả, mức sử dụng model và dấu thời gian thành các sự kiện có kiểu trong kho DuckDB cục bộ. ID agent và phiên kết nối các bản ghi. Bảng điều khiển và các bộ phát hiện hoạt động từ cùng lịch sử đó.

Claude CodePhiên JSONL
CodexBản ghi Rollout
CursorLocal SQLite
OpenClawLogs + gateway
Cài một lần. Giữ nguyên agent và quy trình hiện có.
Khám phá kiến trúc thu thập
Log phiên runtime Ví dụ đã đơn giản hóa

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

Runtime adapter → sự kiện có kiểu → kho cục bộ
Một sự kiện có cấu trúc DuckDB
Agent
Claude Code
Công cụ
Đọc
Mục tiêu
~/.aws/credentials
Kết quả
Công cụ hoàn tất
Ngữ cảnh
Phiên + dấu thời gian + ID lệnh gọi công cụ
02 Làm cho công việc trở nên minh bạch

Xem trình tự. Hiểu hành vi.

Guard chuyển lịch sử sự kiện thành dòng thời gian để bạn điều tra: ai đã hành động, công cụ nào đã chạy, nó đã chạm đến gì và điều gì xảy ra tiếp theo. Một lần đọc thông tin xác thực theo sau bởi một yêu cầu bên ngoài là trình tự bạn có thể thấy và kiểm tra.

Bên dưới dòng thời gian, Guard trích xuất bề mặt hành động từ các đối số công cụ đã ghi: đường dẫn tệp, mẫu lệnh, máy chủ đích và liệu yêu cầu đọc hay ghi. Những tín hiệu đó trở thành đầu vào cho các kiểm tra hành vi.

Các tín hiệu mà bộ phát hiện có thể phân tích
Đường dẫn tệpLệnhHostsĐọc / ghi
  • Biết agent và phiên nào đã hành động.
  • Xem các công cụ, đối số và kết quả theo thứ tự.
  • Mở bằng chứng đằng sau một phát hiện.
Claude Code

Hoạt động phiên

Trình tự minh họa
  1. Đọc tệp dự án

    src/settings.py

  2. Đọc tệp thông tin xác thực

    ~/.aws/credentials

  3. Gọi đến máy chủ bên ngoài

    https://api.example.com

  4. Đã ghi nhận bằng chứng hành vi

    Truy cập thông tin xác thực và hoạt động mạng trong một dòng thời gian.

Hoạt động minh họa, được liên kết theo agent, phiên và thời gian. Các phát hiện trỏ về các bước đã ghi đã kích hoạt chúng.

03Chạy các bộ phát hiện

Mười sáu kiểm tra. Sáu cách phát hiện sự cố.

Từ một vòng lặp kẹt đến không gian làm việc rủi ro hay một mẫu xuyên suốt các phiên, Guard kiểm tra bằng chứng bằng các quy tắc nhẹ và dễ giải thích. Mỗi phát hiện cho bạn biết điều gì khớp và tại sao.

12kiểm tra phiên
3kiểm tra không gian làm việc
1kiểm tra liên phiên

Chạy cục bộ. Không dùng LLM judge riêng.

Agent có đang hoàn thành công việc không?

Nó đang truy cập hoặc thay đổi gì?

Công việc đã dừng mà không ai hay biết chưa?

Có điều gì nó đọc đang cố chuyển hướng nó không?

Checkout này có thể tự thực thi mã không?

Các phiên độc lập có đang làm cùng một việc bất thường không?

Được hiệu chỉnh theo công việc. Rõ ràng về điều kích hoạt.

Guard bắt đầu với các giá trị mặc định, nhận diện từ vựng công cụ của runtime và điều chỉnh các ngưỡng được hỗ trợ từ các phiên đã quan sát trong giới hạn cho phép. Cấu hình của bạn được ưu tiên. Kết quả phát hiện hiển thị nguồn ngưỡng.

  1. Mặc định
  2. Hồ sơ runtime
  3. Đường cơ sở học được
  4. Ghi đè của bạn
04Ưu tiên sự cố đúng trước

Biết điều gì cần chú ý ngay bây giờ.

Một agent bận rộn có thể tiếp tục tiêu tốn mà không có tiến triển. Guard xếp hạng các phiên theo chi phí ước tính có nguy cơ và giữ hành vi, mức độ nghiêm trọng cùng bằng chứng hỗ trợ bên cạnh ước tính đó.

Khi có dữ liệu về thời gian và chi phí, hệ thống tính giá đoạn bị gắn cờ dựa trên tốc độ tiêu hao quan sát được của phiên. Mở kết quả phát hiện để xem cơ sở tính toán và bước đầu tiên bị liên quan.

Một lần chạy bắt đầu lặp vòngVí dụ minh họa
Đang tiến triển
Lặp lại lệnh gọi công cụ
Bước đầu tiên bị liên quan
Thời lượng bị gắn cờ
Tốc độ tiêu hao quan sát được
Chi phí ước tính có nguy cơ

Ước tính bao gồm đoạn bị gắn cờ, giới hạn ở chi phí đã ghi của phiên. Cơ sở tính toán luôn hiển thị trong sự cố.

05 Kết nối bằng chứng với hành động

Bạn quyết định cách Guard phản ứng.

Tự mình xem xét sự cố, để chính sách phản hồi, hoặc yêu cầu phê duyệt trước khi công cụ chạy. Chọn kiểm soát phù hợp với công việc.

A

Cảnh báo. Kiểm tra. Kiểm soát.

Chuyển kết quả phát hiện đến người chịu trách nhiệm. Xem xét agent, phiên và bằng chứng của nó, sau đó sử dụng các điều khiển Tạm dừng, Tiếp tục, Dừng hoặc Kết thúc để can thiệp.

Sự cố được phát hiện Xem xét bằng chứng Tạm dừng · Tiếp tục · Dừng · Kết thúc
Khám phá điều khiển phiên
B

Thiết lập chính sách cho Guard.

Chọn tín hiệu và phản hồi trước. Một chính sách có thể tạm dừng phiên đang lặp, sau đó kết thúc sau năm phút nếu điều kiện tương tự vẫn khớp.

Phát hiện vòng lặp bị kẹt Tạm dừng phiên Sau 5 phút, nếu vẫn còn khớp Kết thúc phiên
Khám phá chính sách
C

Phê duyệt hành động tiếp theo.

Claude Code, Cursor và GitHub Copilot CLI cung cấp các hook trước công cụ. Guard sử dụng các điểm tích hợp này để kiểm tra hành động được yêu cầu và cho phép bạn phê duyệt hoặc từ chối trước khi thực thi.

Yêu cầu công cụ runtime được hỗ trợ Giữ chờ phê duyệt của người dùng Phê duyệt hoặc từ chối
Khám phá cổng phê duyệt

Một nơi để điều tra và phản hồi. Hoạt động đã ghi cung cấp dữ liệu cho phát hiện và chính sách; các tích hợp trước công cụ đặt phê duyệt ngay tại điểm hành động sắp xảy ra.

Agent của bạn. Bằng chứng của bạn. Kiểm soát của bạn.

Được xây dựng cho thế giới nhiều agent.

Chọn agent tốt nhất cho từng công việc. Duy trì hồ sơ chung về hoạt động của nó và cách nhất quán để điều tra và phản hồi khi nhóm bạn thêm runtime hoặc thay đổi mô hình.

Khám phá ranh giới dữ liệu

Lựa chọn agent của bạn

Dùng các runtime và mô hình khác nhau cho từng công việc. Guard cung cấp một ngôn ngữ chung cho hoạt động của chúng.

Bằng chứng của bạn luôn ở gần

Thu thập và phát hiện chạy trên máy của bạn. Ảnh chụp Cloud chi tiết được mã hóa trên thiết bị và giải mã trên trình duyệt của bạn.

Quyết định của bạn trở thành chính sách

Bắt đầu với khả năng quan sát. Thêm các cảnh báo, chính sách và cổng phê duyệt phù hợp với cách nhóm bạn làm việc.

Để agent của bạn làm việc. Biết khi nào cần can thiệp.

Cài đặt ClawMetry trên máy chạy agent của bạn. Mở Guard, theo dõi một phiên và kiểm tra kết quả phát hiện đầu tiên.

Gói miễn phí bao gồm OpenClaw, NVIDIA NemoClaw và Goose. Gói trả phí bổ sung các runtime khác, cổng phê duyệt và chính sách tự động. Dùng thử 7 ngày không cần thẻ tín dụng.

Bắt đầu trên máy của bạn
pip install clawmetry
clawmetry

Tự động phát hiện các agent được hỗ trợ. Mở tab Guard.

Tìm hiểu sâu hơn khi bạn sẵn sàng.

Làm thế nào để bật điều khiển cho thiết lập của tôi?

Bắt đầu bằng cách quan sát một phiên và chọn các điều khiển phù hợp với runtime của nó. Chính sách tự động mới bắt đầu ở chế độ giám sát để bạn có thể kiểm tra các quyết định trước khi bật hành động.

Hành động tự động phải qua ba khóa riêng biệt: chính sách yêu cầu hành động, máy bật thực thi và gói bao gồm nó. Đặt CLAWMETRY_POLICY_ENFORCE=1 trên node để bật thực thi. Mặc định là 0. Mỗi bước chính sách chỉ kích hoạt tối đa một lần mỗi phiên, kể cả khi khởi động lại.

Các phiên Cursor CLI (cursor-agent) có thể được kiểm soát riêng lẻ. Các cuộc trò chuyện trong trình soạn thảo Cursor dùng chung tiến trình IDE nên không có điều khiển tiến trình riêng.

Trên Windows, Tạm dừng sẽ tạm ngưng tiến trình. Dừng gửi Ctrl+C, tác động đến toàn bộ console. Kết thúc khả dụng khi tiến trình không phản hồi lệnh Dừng.

Với OpenClaw, dùng clawmetry proxy start để bật tạm dừng có thực thi. Guard hiển thị các điều khiển khả dụng cho phiên.

Hook phê duyệt của Claude Code sẽ mở thông qua nếu không thể kết nối dashboard cục bộ, quay lại các lời nhắc quyền thông thường của Claude Code.

Đọc chi tiết thiết lập và điều khiển tiến trình
Bộ phát hiện quan sát gì và được đánh giá như thế nào?

Bộ phát hiện hành vi kiểm tra các đối số và kết quả công cụ đã ghi lại. Chúng hiển thị các mẫu để điều tra, không phải giám sát syscall cấp hệ điều hành. Dòng thời gian hiển thị các hành động đã quan sát, không phải lý luận ẩn của mô hình.

Khi chi phí không khả dụng, Guard đánh dấu cơ sở là không xác định. Ước tính chi tiêu liên quan đến đoạn bị gắn cờ, không phải toàn bộ phiên.

Bản phát lại breakout đã công bố của chúng tôi bao gồm tám tình huống: một phát hiện đúng, hai kết quả hữu ích với nhãn sai và năm không ra kết quả. Hai trong số các trường hợp bỏ sót đó đã được khắc phục. Thẻ điểm ghi lại kết quả và các khoảng trống còn lại.

Đọc thẻ điểm đánh giá Xem lại replay liên phiên Đọc tài liệu Guard
Tôi có thể khám phá tầm nhìn và xem Guard được trình diễn ở đâu?

Cuộc trò chuyện All-In của Satya Nadella vào ngày 15 tháng 9 năm 2026 mô tả kỹ thuật thực tế xung quanh hành vi agent, bằng chứng có thể kiểm toán và kiểm soát của con người. Đây là tài liệu tham chiếu ngành, không phải sự chứng thực của ClawMetry.

Xem toàn bộ cuộc trò chuyện All-In

Tham gia "A Kill Switch for AI Agents You Didn't Build," phiên trực tuyến miễn phí vào thứ Sáu ngày 2 tháng 10 năm 2026 lúc 11:00 ET.

Đặt chỗ