پرش به مطلب اصلی

Metrics، سلامت و هشدارها

پایش فقط برای Engine دارای supportsMonitoring نمایش داده می‌شود. مسیر Metrics در Workspace فهرست Instanceها را نشان می‌دهد و با انتخاب هر سرویس وارد بخش پایش و هشدارها در صفحه مدیریت همان Instance می‌شوید.

چه داده‌ای نمایش داده می‌شود؟

  • وضعیت Runtime و سلامت کلی سرویس
  • تعداد Replicaهای مطلوب و آماده
  • Primary یا نقش اجزای Runtime، در صورت ارائه Provider
  • سری‌های زمانی CPU، Memory و سایر Metricهای Engine
  • Eventهای Runtime و رخدادهای عملیاتی
  • Alarmهای فعال یا تاریخچه هشدار
  • زمان آخرین Backup موفق، در صورت موجودبودن داده

روش بررسی روزانه

  1. سلامت کلی و تعداد Replica آماده را کنترل کنید.
  2. روند CPU و Memory را در بازه مناسب بررسی کنید.
  3. جهش کوتاه را با روند چند نقطه و Eventهای همان زمان مقایسه کنید.
  4. Alarm فعال را با Timeline عملیات، Restart یا Resize تطبیق دهید.
  5. وضعیت آخرین Backup موفق را جدا از سلامت Runtime کنترل کنید.

تفسیر درست Metric

  • یک نقطه منفرد مبنای Resize نیست؛ روند و تکرار را بررسی کنید.
  • صفر بودن Metric می‌تواند مصرف صفر، نبود داده یا اختلال Collector باشد.
  • سلامت سبز Runtime تضمین نمی‌کند Queryهای Application سریع هستند.
  • Alarm پس از رفع علت ممکن است با تأخیر بسته شود.

هنگام مشاهده فشار منابع

  1. بازه زمانی و تداوم فشار را تأیید کنید.
  2. Query، Connection Pool و تعداد اتصال‌ها را بررسی کنید.
  3. Event و Log مرتبط را در همان بازه زمانی مقایسه کنید.
  4. اگر Engine از Resize پشتیبانی می‌کند، تغییر منابع را با برآورد هزینه ثبت کنید.
  5. نتیجه Resize را از Timeline عملیات و سپس Metrics تأیید کنید.

نبود داده

اگر صفحه بدون داده است:

  • قابلیت Monitoring موتور را در ماتریس قابلیت‌ها کنترل کنید.
  • آماده‌بودن Instance و Runtime را بررسی کنید.
  • بازه زمانی را تغییر دهید.
  • صفحه را با دکمه Refresh تازه کنید.
  • خطای API و کد پیگیری را از پیام پنل نگه دارید.

برای خطاهای ماندگار به راهنمای رفع خطا بروید.