کتابخانه آشکارسازهاراه‌اندازی مجدد مکرر

راه‌اندازی مجدد مکرر

دوباره آنلاین. بعد دوباره.

یک جلسه که مدام از اول شروع می‌کند را شناسایی کنید.

مشکل را ببینید. یافته را درک کنید.

روایت انگلیسی با زیرنویس.

چگونه نادیده گرفته می‌شود

عامل دوباره آنلاین می‌شود، پس همه چیز خوب به نظر می‌رسد. بعد دوباره از اول شروع می‌کند. راه‌اندازی‌های مجدد مکرر می‌توانند پشت یک فرآیندی که هر بار که نگاه می‌کنید سالم به نظر می‌رسد پنهان شوند.

یک وظیفه ناتمام در لیست کارهای شما باقی می‌ماند در حالی که زمان اجرا به راه‌اندازی مجدد ادامه می‌دهد. بدون توالی رویدادهای جلسه، هر راه‌اندازی مجدد مثل یک شروع تازه به نظر می‌رسد. با هم، یک مشکل قابلیت اطمینان را نشان می‌دهند که شایسته بررسی است.

آنچه ClawMetry شناسایی می‌کند

ClawMetry شروع‌ها و راه‌اندازی‌های مجدد جلسه ضبط‌شده را در یک پنجره محدود شمارش می‌کند. وقتی به اندازه کافی انباشته شوند، یک یافته راه‌اندازی مجدد مکرر ایجاد می‌کند. شواهد شامل شمارش است و اینکه آیا مقایسه از برچسب‌های زمانی یا پنجره رویداد استفاده کرده است.

تفاوتی که یافته را تغییر می‌دهد

مثال محرک

2 شروع در یک دقیقه

یافته هشداری

مقایسه بدون هشدار

یک شروع واحد

هیچ یافته‌ای برای این آشکارساز وجود ندارد.

مثال بررسی‌شده دو شروع یک دقیقه از هم را ثبت می‌کند و یک هشدار ایجاد می‌کند. یک شروع واحد ساکت می‌ماند. پنجره پیش‌فرض راه‌اندازی مجدد پانزده دقیقه است، و یافته آستانه استفاده‌شده برای آن ارزیابی را گزارش می‌دهد.

نتیجه آشکارساز را بررسی کنید
{
  "kind": "crashed",
  "severity": "warning",
  "evidence": {
    "restarts": 2,
    "threshold": 2,
    "window_sec": 900,
    "threshold_source": "static",
    "observed": "session.started/restarted events counted by timestamps",
    "span_sec": 60
  }
}
ورودی‌ها و نتایج کامل را دانلود کنید (JSON)
چگونه مثال بررسی شد

این مثال‌ها آشکارساز منتشرشده را با داده‌های رویداد نوشته‌شده یا فایل‌های پیکربندی موقت ارزیابی می‌کنند. ویدیوها آن رفتارها را نشان می‌دهند. آنها ضبط عوامل زنده یا رابط محصول نیستند. هیچ دستوری در مثال‌ها اجرا نشده است.

نتیجه رفتار را برای این ورودی‌ها تعیین می‌کند. این نتیجه جذب زمان اجرا، پیشگیری یا یک نقض واقعی را ثابت نمی‌کند. قرارداد منبع ثابت‌شده را بررسی کنید.

آنچه بعداً باید بررسی کنید

گزارش‌های زمان اجرا را برای دلایل خروج و خطاهای راه‌اندازی بررسی کنید. فشار منابع و آخرین عمل قبل از راه‌اندازی مجدد را بررسی کنید. وقتی علت برطرف شد، تأیید کنید که عامل در حال اجرا می‌ماند و به وظیفه اصلی برمی‌گردد.

  1. گزارش‌های خروج زمان اجرا را بخوانید
  2. عمل قبلی را بررسی کنید
  3. تأیید کنید جلسه ادامه‌دار می‌ماند

آنچه این سیگنال ثابت می‌کند

رویدادهای شروع مکرر یک سیگنال قابلیت اطمینان هستند. دلیل خرابی را ثابت نمی‌کنند، و یک راه‌اندازی مجدد عمدی می‌تواند به شمارش اضافه کند.

لحظه‌های مهم را مرئی نگه دارید.

فعالیت عامل را دنبال کنید، یافته‌ها را بررسی کنید و تصمیم بگیرید چه چیزی نیاز به توجه دارد.