CodeShot

مسیر یادگیری Monitoring

جمع‌آوری و بررسی مداوم متریک، لاگ و Trace یک سیستم برای شناسایی مشکلات عملکردی یا خرابی، ترجیحاً پیش از آنکه کاربر متوجه آن شود.

8 مرحله

  1. 1.

    Grafana چیست؟

    ابزار متن‌باز مصورسازی داده و ساخت Dashboard؛ متریک‌های جمع‌آوری‌شده از منابعی مثل Prometheus، Elasticsearch یا SQL Server را به نمودار و هشدار تبدیل می‌کند.

    ~6 ساعت
  2. 2.

    Monitoring (پایش) چیست؟

    جمع‌آوری و بررسی مداوم متریک، لاگ و Trace یک سیستم برای شناسایی مشکلات عملکردی یا خرابی، ترجیحاً پیش از آنکه کاربر متوجه آن شود.

    ~6 ساعت
  3. 3.

    Prometheus چیست؟

    سیستم متن‌باز جمع‌آوری و ذخیره Metrics بر پایه مدل Pull، با پایگاه داده سری‌زمانی (Time-Series) و زبان پرس‌وجوی اختصاصی PromQL.

    ~6 ساعت
  4. 4.

    آشنایی با Log، Metric و Trace

    سه ستون اصلی Observability یعنی لاگ‌ها، متریک‌ها و ترِیس‌های توزیع‌شده را معرفی و کاربرد هرکدام را در عیب‌یابی سیستم توضیح می‌دهد.

    ~4 ساعت
  5. 5.

    پیاده‌سازی Health Check برای سرویس‌ها

    نحوه پیاده‌سازی endpoint های Health Check برای تشخیص خودکار سرویس‌های ناسالم توسط ابزارهای Orchestration را توضیح می‌دهد.

    ~3 ساعت
  6. 6.

    تعریف قوانین هشدار و Alerting

    روش تعریف قوانین هشدار بر اساس آستانه متریک‌ها و اطلاع‌رسانی به تیم On-call هنگام بروز مشکل را شرح می‌دهد.

    ~4 ساعت
  7. 7.

    ساخت داشبورد مانیتورینگ سیستم

    نحوه ساخت داشبوردهای بصری شبیه Grafana برای نمایش لحظه‌ای وضعیت سیستم‌ها و روند متریک‌ها را آموزش می‌دهد.

    ~5 ساعت
  8. 8.

    مانیتورینگ عملکرد با APM

    ابزارهای Application Performance Monitoring را برای ردیابی تراکنش‌ها، شناسایی گلوگاه‌های عملکردی و تحلیل عمیق Trace ها معرفی می‌کند.

    ~5 ساعت