فناوری · رصدپذیری
Prometheus و Grafana در دزکوب
جمعآوری متریک، هشدار و داشبورد
- نسخهٔ پینشده
- ⟦V_PROMETHEUS⟧
- لایسنس
- Apache 2.0
- گروه در استک
- رصدپذیری
Prometheus و Grafana چیست
Prometheus متریکها را جمعآوری و ذخیره میکند؛ Grafana آنها را نمایش میدهد؛ و اپراتور، این پشته را بهصورت منابع Kubernetes مدیریت میکند.
چرا این را انتخاب کردیم
| گزینهای که رد شد | چرا نه |
|---|---|
| سامانهٔ پایش تجاری | لایسنس و وابستگی خارجی |
| بدون رصدپذیری | «چرا کند شده؟» بیجواب میماند |
دلیل تعیینکننده
استاندارد عملی این حوزه است و تقریباً هر مؤلفهای که استفاده میکنیم متریک با همین قالب منتشر میکند.
ما دقیقاً چطور استفادهاش میکنیم
- نصب بهعنوان افزونهٔ پینشده، از قبل وصل — نه «میتوانید نصب کنید».
- جمعآوری خودکار متریک بار کاریها.
- متریکهای خودِ کنترلپلن: مدت reconcile، خطای همگامسازی، واگرایی تشخیصدادهشده، عمق صف، نسبت شکست بیلد، وضعیت انتخاب رهبر، تأخیر projection.
- قواعد هشدار پیشفرض پلتفرم، بههمراه امکان قواعد سفارشی.
- محاسبهٔ SLO و بودجهٔ خطا روی همین داده.
برای شما چه چیزی عوض میشود
- نصب و اتصال دستی پشتهٔ پایشاز قبل وصل
- پلتفرم یک جعبهٔ سیاهکنترلپلن خودش را هم منتشر میکند
مرزها و محدودیتها
این سکشن در هر صفحهٔ فناوری اجباری است. هر ابزاری مرزی دارد؛ صفحهای که مرزش را نگوید، بقیهاش هم قابل اتکا نیست.
- Prometheus برای دادهٔ سریزمانی با دورهٔ نگهداری محدود طراحی شده. برای نگهداری بلندمدت، باید به یک ذخیرهگاه بلندمدت متصل شود — که در معماری مرجع پوشش داده شده.
- تعداد بسیار زیاد برچسبهای یکتا (cardinality بالا) میتواند مصرف حافظه را بالا ببرد. این یک مسئلهٔ طراحی متریک است و در مستندات پوشش داده شده.
اینها را هم ببینید
این را روی زیرساخت خودتان ببینید.
همین مؤلفه را در کلاستر شما پیکربندی میکنیم و نشان میدهیم.