ClawMetry Guard

AI-কে কাজে লাগান। নিয়ন্ত্রণ রাখুন নিজের হাতে।

এজেন্টরা আপনার পক্ষে ফাইল পড়ে, কমান্ড চালায় এবং সার্ভিস কল করে। Guard সেই কাজকে পর্যবেক্ষণযোগ্য করে তোলে, ঝুঁকিপূর্ণ আচরণ যাচাই করে এবং আপনাকে পদক্ষেপ নেওয়ার প্রমাণ ও নিয়ন্ত্রণ দেয়।

7 দিনের ট্রায়াল। ক্রেডিট কার্ড লাগবে না। আপনি যে এজেন্টগুলো ইতিমধ্যে ব্যবহার করেন, সেগুলোর সাথেই কাজ করে।

দৃষ্টিভঙ্গি

দীর্ঘমেয়াদী এজেন্টদের একটি অপারেশনস স্তর দরকার।

এজেন্টরা ফাইল, ক্রেডেনশিয়াল ও সার্ভিসে প্রবেশাধিকার নিয়ে ঘণ্টার পর ঘণ্টা কাজ করতে পারে। সেই কাজে অপারেশনাল শৃঙ্খলা আনুন: ক্রমাগত পর্যবেক্ষণ, আচরণগত প্রমাণ এবং কিছু ভুল হলে থামানোর উপায়। Guard আপনার দলকে সেই দৃশ্যমানতা ও নিয়ন্ত্রণ দেয়, যাতে আরও বেশি স্বায়ত্তশাসন কাজে লাগানো যায়।

"সবকিছু অবশ্যই নিরীক্ষাযোগ্য হতে হবে।"

Satya Nadella · All-In · 15 September 2026 · 9:30
01 কার্যকলাপ সংগ্রহ করুন

আপনার এজেন্টরা চিহ্ন রেখে যায়। আমরা তা পড়ার উপযোগী করি।

Claude Code JSONL লেখে। Codex রোলআউট রেকর্ড করে। Cursor স্থানীয়ভাবে SQLite-এ সেশন ডেটা রাখে। OpenClaw লগ ও একটি গেটওয়ে উন্মুক্ত করে। ClawMetry এই উৎসগুলো আবিষ্কার করে এবং প্রতিটি ফরম্যাট পড়তে রানটাইম-নির্দিষ্ট অ্যাডাপ্টার ব্যবহার করে।

ব্যাকগ্রাউন্ড কালেক্টর কল, ফলাফল, মডেল ব্যবহার ও টাইমস্ট্যাম্পকে একটি স্থানীয় DuckDB স্টোরে টাইপড ইভেন্টে রূপান্তরিত করে। এজেন্ট ও সেশন আইডি রেকর্ডগুলো সংযুক্ত করে। ড্যাশবোর্ড ও ডিটেক্টর উভয়ই সেই একই ইতিহাস থেকে কাজ করে।

Claude CodeJSONL sessions
CodexRollout records
CursorLocal SQLite
OpenClawLogs + gateway
একবার ইনস্টল করুন। আপনার বিদ্যমান এজেন্ট ও ওয়ার্কফ্লো যেমন আছে তেমনই থাকবে।
সংগ্রহের আর্কিটেকচার দেখুন
রানটাইম সেশন লগ সরলীকৃত উদাহরণ

{"type": "tool_use",
 "name": "Read",
 "input": {"file_path": "~/.aws/credentials"},
 "id": "call_07"}

{"type": "tool_result",
 "tool_use_id": "call_07",
 "is_error": false}

Runtime adapter → typed event → local store
একটি কাঠামোবদ্ধ ইভেন্ট DuckDB
এজেন্ট
Claude Code
টুল
Read
লক্ষ্য
~/.aws/credentials
ফলাফল
টুল সম্পন্ন হয়েছে
প্রসঙ্গ
সেশন + টাইমস্ট্যাম্প + টুল কল ID
02 কাজকে পর্যবেক্ষণযোগ্য করুন

ক্রমটি দেখুন। আচরণটি বুঝুন।

Guard ইভেন্ট ইতিহাসকে একটি তদন্তযোগ্য টাইমলাইনে রূপান্তরিত করে: কে কাজ করেছে, কোন টুল চলেছে, কী স্পর্শ করেছে এবং পরে কী ঘটেছে। একটি ক্রেডেনশিয়াল পড়ার পরে বাহ্যিক অনুরোধ একটি ধারাবাহিকতা যা আপনি দেখত ও পরীক্ষা করতে পারেন।

টাইমলাইনের নিচে Guard রেকর্ড করা টুল আর্গুমেন্ট থেকে অ্যাকশন সারফেস বের করে: ফাইল পাথ, কমান্ড প্যাটার্ন, গন্তব্য হোস্ট এবং একটি অনুরোধ পড়ে নাকি লেখে। এই সংকেতগুলো আচরণগত যাচাইয়ের ইনপুট হয়ে ওঠে।

ডিটেক্টর যে সংকেতগুলো বিশ্লেষণ করতে পারে
ফাইল পাথকমান্ডহোস্টপড়া / লেখা
  • কোন এজেন্ট ও সেশন কাজটি করেছে জানুন।
  • টুল, আর্গুমেন্ট ও ফলাফল ক্রমানুসারে দেখুন।
  • একটি ফাইন্ডিংয়ের পেছনের প্রমাণ খুলে দেখুন।
Claude Code

সেশন কার্যকলাপ

উদাহরণমূলক ক্রম
  1. প্রজেক্ট ফাইল পড়া

    src/settings.py

  2. একটি ক্রেডেনশিয়াল ফাইল পড়া

    ~/.aws/credentials

  3. একটি বাহ্যিক হোস্টে কল

    https://api.example.com

  4. আচরণগত প্রমাণ রেকর্ড করা হয়েছে

    ক্রেডেনশিয়াল অ্যাক্সেস ও নেটওয়ার্ক কার্যকলাপ একই টাইমলাইনে।

এজেন্ট, সেশন ও সময় দ্বারা সংযুক্ত দৃষ্টান্তমূলক কার্যক্রম। ফলাফলগুলো সেই রেকর্ড করা পদক্ষেপগুলোতে ফিরে নির্দেশ করে যেগুলো সেগুলো ট্রিগার করেছিল।

03ডিটেক্টর চালান

ষোলটি পরীক্ষা। সমস্যা চেনার ছটি উপায়।

লুপিং রান থেকে ঝুঁকিপূর্ণ ওয়ার্কস্পেস বা সেশন জুড়ে প্যাটার্ন পর্যন্ত, Guard হালকা ও ব্যাখ্যাযোগ্য নিয়ম দিয়ে প্রমাণ যাচাই করে। প্রতিটি ফলাফল বলে কী মিলেছে এবং কেন।

12সেশন পরীক্ষা
3ওয়ার্কস্পেস পরীক্ষা
1ক্রস-সেশন পরীক্ষা

স্থানীয়ভাবে চলে। আলাদা কোনো LLM judge নেই।

এজেন্ট কি কাজ সম্পন্ন করছে?

এটি কী স্পর্শ করছে বা পরিবর্তন করছে?

কেউ না জেনেই কি কাজ থেমে গেছে?

এটি যা পড়েছে তা কি তাকে পুনর্নির্দেশিত করার চেষ্টা করছে?

এই চেকআউট কি নিজে থেকে কোড কার্যকর করতে পারে?

স্বাধীন সেশনগুলো কি একই অস্বাভাবিক কাজ করছে?

কাজের সাথে সামঞ্জস্যপূর্ণ। ট্রিগার সম্পর্কে স্পষ্ট।

Guard ডিফল্ট দিয়ে শুরু করে, রানটাইমের টুল ভোকাবুলারি চেনে এবং সীমার মধ্যে পর্যবেক্ষণ করা সেশন থেকে সমর্থিত থ্রেশহোল্ড মানিয়ে নেয়। আপনার ওভাররাইড সর্বদা অগ্রাধিকার পায়। ফলাফল থ্রেশহোল্ডের উৎস দেখায়।

  1. ডিফল্ট
  2. রানটাইম প্রোফাইল
  3. শেখা বেসলাইন
  4. আপনার ওভাররাইড
04সঠিক ঘটনাটিকে প্রথমে রাখুন

এখন কোনটিতে মনোযোগ দেওয়া দরকার তা জানুন।

একটি ব্যস্ত এজেন্ট কোনো অগ্রগতি না করে ব্যয় করতে থাকতে পারে। Guard আনুমানিক ঝুঁকিপূর্ণ ব্যয় অনুযায়ী সেশন র‍্যাংক করে এবং সেই অনুমানের পাশে আচরণ, গুরুত্ব ও সহায়ক প্রমাণ রাখে।

টাইমিং ও খরচের তথ্য পাওয়া গেলে, সেশনের পর্যবেক্ষিত বার্ন রেট ব্যবহার করে ফ্ল্যাগ করা অংশের মূল্য নির্ধারণ করা হয়। হিসাবের ভিত্তি এবং প্রথম সংশ্লিষ্ট ধাপ দেখতে ফাইন্ডিংটি খুলুন।

একটি রান যা লুপ করতে শুরু করেউদাহরণমূলক দৃষ্টান্ত
অগ্রগতি হচ্ছে
পুনরাবৃত্ত টুল কল
প্রথম সংশ্লিষ্ট ধাপ
ফ্ল্যাগ করা সময়কাল
পর্যবেক্ষিত বার্ন রেট
আনুমানিক ঝুঁকিপূর্ণ ব্যয়

এই আনুমানিক হিসাব ফ্ল্যাগ করা অংশটি কভার করে, সেশনের নথিভুক্ত খরচের মধ্যে সীমাবদ্ধ। এর ভিত্তি ইনসিডেন্টে দৃশ্যমান থাকে।

05 প্রমাণকে পদক্ষেপের সাথে যুক্ত করুন

Guard কীভাবে সাড়া দেবে, তা আপনিই ঠিক করেন।

নিজে একটি ইনসিডেন্ট পর্যালোচনা করুন, একটি পলিসিকে সাড়া দিতে দিন, অথবা টুল চলার আগে অনুমোদন চান। কাজের সাথে মানানসই নিয়ন্ত্রণটি বেছে নিন।

A

সতর্ক করুন। পরীক্ষা করুন। নিয়ন্ত্রণ নিন।

দায়িত্বশীল ব্যক্তির কাছে একটি ফলাফল নিয়ে আসুন। এর এজেন্ট, সেশন ও প্রমাণ পর্যালোচনা করুন, তারপর হস্তক্ষেপ করতে উপলব্ধ Pause, Resume, Stop বা Kill নিয়ন্ত্রণ ব্যবহার করুন।

ইনসিডেন্ট শনাক্ত হয়েছে প্রমাণ পর্যালোচনা করুন Pause · Resume · Stop · Kill
সেশন নিয়ন্ত্রণ দেখুন
B

Guard-কে একটি পলিসি দিন।

আগে থেকেই সংকেত ও প্রতিক্রিয়া বেছে নিন। একটি পলিসি লুপিং সেশন বিরতি দিতে পারে, তারপর পাঁচ মিনিট পরেও একই শর্ত মিললে তা বন্ধ করে দিতে পারে।

আটকে থাকা লুপ শনাক্ত হয়েছে সেশনটি পজ করুন 5 মিনিট পরে, যদি এখনও মিলে যায় সেশন বন্ধ করুন
পলিসি দেখুন
C

পরবর্তী পদক্ষেপ অনুমোদন করুন।

Claude Code, Cursor এবং GitHub Copilot CLI প্রি-টুল হুক উন্মুক্ত করে। Guard এই ইন্টিগ্রেশন পয়েন্টগুলো ব্যবহার করে অনুরোধ করা অ্যাকশন যাচাই করে এবং কার্যকর হওয়ার আগে আপনাকে অনুমোদন বা প্রত্যাখ্যানের সুযোগ দেয়।

সমর্থিত রানটাইম টুল অনুরোধ মানুষের অনুমোদনের জন্য আটকে রাখুন অনুমোদন বা প্রত্যাখ্যান
অনুমোদন গেট দেখুন

তদন্ত ও প্রতিক্রিয়ার জন্য একটি জায়গা। রেকর্ড করা কার্যক্রম ডিটেকশন ও পলিসিকে পুষ্ট করে; প্রি-টুল ইন্টিগ্রেশন অ্যাকশন ঘটার মুহূর্তে অনুমোদন রাখে।

আপনার এজেন্ট। আপনার প্রমাণ। আপনার নিয়ন্ত্রণ।

অনেক এজেন্টের জগতের জন্য তৈরি।

প্রতিটি কাজের জন্য সেরা এজেন্ট বেছে নিন। তার কাজের একটি সাধারণ রেকর্ড এবং তদন্ত ও প্রতিক্রিয়ার একটি সামঞ্জস্যপূর্ণ উপায় রাখুন, যখন আপনার দল রানটাইম যোগ করে বা মডেল পরিবর্তন করে।

ডেটার সীমানা দেখুন

আপনার পছন্দের এজেন্ট

বিভিন্ন কাজের জন্য ভিন্ন রানটাইম ও মডেল ব্যবহার করুন। Guard তাদের কার্যক্রমকে একটি সাধারণ ভাষায় উপস্থাপন করে।

আপনার প্রমাণ কাছেই থাকে

সংগ্রহ ও শনাক্তকরণ আপনার মেশিনেই চলে। বিস্তারিত Cloud স্ন্যাপশট ডিভাইসে এনক্রিপ্ট এবং আপনার ব্রাউজারে ডিক্রিপ্ট করা হয়।

আপনার সিদ্ধান্তই নীতি হয়

দৃশ্যমানতা দিয়ে শুরু করুন। আপনার টিমের কাজের ধরন অনুযায়ী অ্যালার্ট, নীতি ও অনুমোদনের গেট যোগ করুন।

আপনার এজেন্টদের কাজে লাগান। কখন হস্তক্ষেপ করতে হবে তা জানুন।

যে মেশিনে আপনার এজেন্টরা চলে, সেখানে ClawMetry ইনস্টল করুন। Guard খুলুন, একটি সেশন অনুসরণ করুন এবং আপনার প্রথম ফাইন্ডিং যাচাই করুন।

ফ্রি প্ল্যানে OpenClaw, NVIDIA NemoClaw এবং Goose অন্তর্ভুক্ত। পেইড প্ল্যানে আরও রানটাইম, অনুমোদন গেট ও স্বয়ংক্রিয় পলিসি যুক্ত হয়। 7 দিনের ট্রায়ালে ক্রেডিট কার্ড লাগে না।

আপনার মেশিনে শুরু করুন
pip install clawmetry
clawmetry

সমর্থিত এজেন্ট স্বয়ংক্রিয়ভাবে শনাক্ত করে। Guard ট্যাব খুলুন।

প্রস্তুত হলে আরও গভীরে যান।

আমার সেটআপের জন্য কীভাবে নিয়ন্ত্রণ চালু করব?

একটি সেশন পর্যবেক্ষণ করে শুরু করুন এবং রানটাইমের সাথে মানানসই নিয়ন্ত্রণ বেছে নিন। একটি নতুন স্বয়ংক্রিয় পলিসি মনিটর মোডে শুরু হয়, যাতে অ্যাকশন সক্রিয় করার আগে আপনি এর সিদ্ধান্তগুলো পরীক্ষা করতে পারেন।

স্বয়ংক্রিয় পদক্ষেপকে তিনটি আলাদা লক পার হতে হয়: পলিসি একটি পদক্ষেপ অনুরোধ করে, মেশিন এনফোর্সমেন্ট চালু করে, এবং প্ল্যানে তা অন্তর্ভুক্ত থাকে। এনফোর্সমেন্ট চালু করতে নোডে CLAWMETRY_POLICY_ENFORCE=1 সেট করুন। ডিফল্ট মান 0। প্রতিটি পলিসি ধাপ প্রতি সেশনে সর্বোচ্চ একবার চলে, রিস্টার্টের পরেও।

Cursor CLI (cursor-agent) সেশনগুলো আলাদাভাবে নিয়ন্ত্রণ করা যায়। Cursor এডিটরের কথোপকথনগুলো IDE প্রসেস ভাগ করে নেয়, তাই সেগুলোর আলাদা প্রসেস নিয়ন্ত্রণ নেই।

Windows-এ, Pause প্রসেসটি সাসপেন্ড করে। Stop পাঠায় Ctrl+C, যা পুরো কনসোলে পৌঁছায়। কোনো প্রসেস Stop-এ সাড়া না দিলে Kill ব্যবহার করা যায়।

OpenClaw-এর জন্য, এনফোর্সড পজ চালু করতে clawmetry proxy start ব্যবহার করুন। Guard সেশনের জন্য উপলব্ধ নিয়ন্ত্রণগুলো দেখায়।

লোকাল ড্যাশবোর্ডে পৌঁছানো না গেলে Claude Code অনুমোদন হুক fail open করে, অর্থাৎ Claude Code-এর স্বাভাবিক পারমিশন প্রম্পটে ফিরে যায়।

সেটআপ ও প্রসেস নিয়ন্ত্রণের বিস্তারিত পড়ুন
ডিটেক্টর কী পর্যবেক্ষণ করে, আর কীভাবে তাদের মূল্যায়ন করা হয়?

আচরণ ডিটেক্টর রেকর্ড করা টুল আর্গুমেন্ট ও ফলাফল পরীক্ষা করে। এগুলো তদন্তের জন্য প্যাটার্ন তুলে ধরে; এগুলো অপারেটিং সিস্টেম syscall মনিটরিং নয়। টাইমলাইন পর্যবেক্ষিত কাজ দেখায়, মডেলের লুকানো যুক্তি নয়।

খরচ জানা না গেলে Guard এর ভিত্তি অজানা হিসেবে চিহ্নিত করে। খরচের অনুমান শুধু চিহ্নিত অংশের জন্য, পুরো সেশনের জন্য নয়।

আমাদের প্রকাশিত breakout replay-তে আটটি পরিস্থিতি আছে: একটি পরিষ্কারভাবে ধরা পড়েছে, দুটিতে ভুল লেবেলসহ কার্যকর ফাইন্ডিং এসেছে, এবং পাঁচটিতে কিছুই আসেনি। সেই মিসগুলোর দুটি পরে ঠিক করা হয়েছে। স্কোরকার্ডে ফলাফল ও বাকি ঘাটতিগুলো লেখা আছে।

মূল্যায়নের স্কোরকার্ড পড়ুন ক্রস-সেশন রিপ্লে পড়ুন Guard ডকুমেন্টেশন পড়ুন
ভিশনটি কোথায় জানতে পারব এবং Guard-এর ডেমো কোথায় দেখব?

15 September 2026-এর All-In কথোপকথনে Satya Nadella এজেন্ট আচরণ, নিরীক্ষাযোগ্য প্রমাণ ও মানব নিয়ন্ত্রণের বাস্তব ইঞ্জিনিয়ারিং বর্ণনা করেন। এটি একটি শিল্প রেফারেন্স, ClawMetry-এর সমর্থন নয়।

পুরো All-In আলোচনাটি দেখুন

“A Kill Switch for AI Agents You Didn’t Build” সেশনে যোগ দিন, একটি বিনামূল্যের অনলাইন সেশন, শুক্রবার 2 অক্টোবর 2026, 11:00 ET-এ।

আসন সংরক্ষণ করুন