مسیر یادگیری Monitoring
جمعآوری و بررسی مداوم متریک، لاگ و Trace یک سیستم برای شناسایی مشکلات عملکردی یا خرابی، ترجیحاً پیش از آنکه کاربر متوجه آن شود.
8 مرحله
- 1.
Grafana چیست؟
ابزار متنباز مصورسازی داده و ساخت Dashboard؛ متریکهای جمعآوریشده از منابعی مثل Prometheus، Elasticsearch یا SQL Server را به نمودار و هشدار تبدیل میکند.
~6 ساعت - 2.
Monitoring (پایش) چیست؟
جمعآوری و بررسی مداوم متریک، لاگ و Trace یک سیستم برای شناسایی مشکلات عملکردی یا خرابی، ترجیحاً پیش از آنکه کاربر متوجه آن شود.
~6 ساعت - 3.
Prometheus چیست؟
سیستم متنباز جمعآوری و ذخیره Metrics بر پایه مدل Pull، با پایگاه داده سریزمانی (Time-Series) و زبان پرسوجوی اختصاصی PromQL.
~6 ساعت - 4.
آشنایی با Log، Metric و Trace
سه ستون اصلی Observability یعنی لاگها، متریکها و ترِیسهای توزیعشده را معرفی و کاربرد هرکدام را در عیبیابی سیستم توضیح میدهد.
~4 ساعت - 5.
پیادهسازی Health Check برای سرویسها
نحوه پیادهسازی endpoint های Health Check برای تشخیص خودکار سرویسهای ناسالم توسط ابزارهای Orchestration را توضیح میدهد.
~3 ساعت - 6.
تعریف قوانین هشدار و Alerting
روش تعریف قوانین هشدار بر اساس آستانه متریکها و اطلاعرسانی به تیم On-call هنگام بروز مشکل را شرح میدهد.
~4 ساعت - 7.
ساخت داشبورد مانیتورینگ سیستم
نحوه ساخت داشبوردهای بصری شبیه Grafana برای نمایش لحظهای وضعیت سیستمها و روند متریکها را آموزش میدهد.
~5 ساعت - 8.
مانیتورینگ عملکرد با APM
ابزارهای Application Performance Monitoring را برای ردیابی تراکنشها، شناسایی گلوگاههای عملکردی و تحلیل عمیق Trace ها معرفی میکند.
~5 ساعت
