بازگشت به وبلاگ


زیرساخت۱۵ خرداد ۱۴۰۵·۹ دقیقه
مانیتورینگ محصول در production
از لاگ و متریک تا هشدار — چطور مشکلات را قبل از کاربر پیدا کنیم و زمان پاسخ را کوتاه کنیم.
نویسنده: علی کریمی
مانیتورینگ خوب یعنی قبل از اینکه کاربر تیکت بزند، تیم از مشکل باخبر شود. این کار با ترکیب لاگ، متریک و هشدار هوشمند ممکن میشود.
متریکهایی که واقعاً مهماند
نرخ خطا، زمان پاسخ API، saturation منابع و SLA مسیرهای حیاتی باید روی داشبورد مشخص باشند. متریک زیاد بدون اولویتبندی فقط noise ایجاد میکند.
Runbook و پاسخ به incident
برای هر هشدار مهم، یک runbook کوتاه بنویسید: چه کسی مسئول است، اولین گام بررسی چیست و چه زمانی rollback انجام دهیم. در لحظه بحران، این مستندات ارزش زیادی دارند.
امتیازدهی
این مقاله چقدر برای شما مفید بود؟
برای امتیازدهی روی ستارهها کلیک کنید.
نظرات
نظر خود را با دیگران به اشتراک بگذارید.
ثبت نظر
دیدگاه خود را درباره این مقاله با ما به اشتراک بگذارید.
مقالات مرتبط
مطالب بیشتر در دسته زیرساخت

زیرساخت۱۲ تیر ۱۴۰۵·۷ دقیقه
DevOps برای تیمهای کوچک: از کجا شروع کنیم؟
گامهای عملی برای استقرار خودکار، مانیتورینگ و زیرساخت ابری بدون پیچیدگی اضافی.