Dezkubeدزکوب

فناوری · رصدپذیری

Prometheus و Grafana در دزکوب

جمع‌آوری متریک، هشدار و داشبورد

نسخهٔ پین‌شده
⟦V_PROMETHEUS⟧
لایسنس
Apache 2.0
گروه در استک
رصدپذیری

Prometheus و Grafana چیست

Prometheus متریک‌ها را جمع‌آوری و ذخیره می‌کند؛ Grafana آن‌ها را نمایش می‌دهد؛ و اپراتور، این پشته را به‌صورت منابع Kubernetes مدیریت می‌کند.

چرا این را انتخاب کردیم

گزینه‌هایی که بررسی و رد شدند، و دلیل رد هر کدام
گزینه‌ای که رد شدچرا نه
سامانهٔ پایش تجاریلایسنس و وابستگی خارجی
بدون رصدپذیری«چرا کند شده؟» بی‌جواب می‌ماند
دلیل تعیین‌کننده

استاندارد عملی این حوزه است و تقریباً هر مؤلفه‌ای که استفاده می‌کنیم متریک با همین قالب منتشر می‌کند.

ما دقیقاً چطور استفاده‌اش می‌کنیم

  • نصب به‌عنوان افزونهٔ پین‌شده، از قبل وصل — نه «می‌توانید نصب کنید».
  • جمع‌آوری خودکار متریک بار کاری‌ها.
  • متریک‌های خودِ کنترل‌پلن: مدت reconcile، خطای همگام‌سازی، واگرایی تشخیص‌داده‌شده، عمق صف، نسبت شکست بیلد، وضعیت انتخاب رهبر، تأخیر projection.
  • قواعد هشدار پیش‌فرض پلتفرم، به‌همراه امکان قواعد سفارشی.
  • محاسبهٔ SLO و بودجهٔ خطا روی همین داده.

برای شما چه چیزی عوض می‌شود

  • نصب و اتصال دستی پشتهٔ پایشاز قبل وصل
  • پلتفرم یک جعبهٔ سیاهکنترل‌پلن خودش را هم منتشر می‌کند

مرزها و محدودیت‌ها

این سکشن در هر صفحهٔ فناوری اجباری است. هر ابزاری مرزی دارد؛ صفحه‌ای که مرزش را نگوید، بقیه‌اش هم قابل اتکا نیست.

  • Prometheus برای دادهٔ سری‌زمانی با دورهٔ نگهداری محدود طراحی شده. برای نگهداری بلندمدت، باید به یک ذخیره‌گاه بلندمدت متصل شود — که در معماری مرجع پوشش داده شده.
  • تعداد بسیار زیاد برچسب‌های یکتا (cardinality بالا) می‌تواند مصرف حافظه را بالا ببرد. این یک مسئلهٔ طراحی متریک است و در مستندات پوشش داده شده.

این را روی زیرساخت خودتان ببینید.

همین مؤلفه را در کلاستر شما پیکربندی می‌کنیم و نشان می‌دهیم.