Bir milyon saytı izləmək üçün qurulmuşdur
İdarə panelinizin arxasında platformamızı işlətdiyimiz eyni izlənilabilirlik steki dayanır: metrikalar üçün Prometheus və Grafana, mühərrik, iş axınları və drayverlər üzrə paylanmış treydinq üçün OpenTelemetry, həmçinin audit məlumatlarının ayrı saxlandığı tenant-teqlərlə etiketlənmiş mərkəzləşdirilmiş strukturlaşdırılmış loqlar.
Metriklər hər xidmət, hər işçi və hər kirayəçi üzrə toplanır, izolyasiya qatından isə hər sayt üzrə LVE statistikası əldə edilir. Təminat, miqrasiya, tətbiqetmə daxil olmaqla hər iş axını əvvəldən axıra qədər görünəndir; məhz buna görə də dəstək cavabı təxminə əsaslanmaq əvəzinə dəqiq ola bilər.
Miqyasda monitorinq data həcmi problemidir, ona görə də məhz belə də layihələndirilib. Yüksək həcmli metrikalar hər sayt və hər dəqiqə üzrə əbədi saxlanılmaq əvəzinə zamana görə bölünüb ümumiləşdirilir, treyslərdən nümunələr götürülür və hər tenant üzrə kardinallıq nəzarəti bir səs-küylü hesabın digər hər kəsin idarə panelini pisləşdirməsinin qarşısını alır. Layihənin hədəfi bu gün işlətdiyimiz saytların sayı deyil, bir milyon saytdır.
Xəbərdarlıqlar müəyyən edilmiş və izlənən SLO-lar ilə Alertmanager vasitəsilə növbətçi qrupumuza yönləndirilir — yuxarıdakı müştəri bildirişlərindən qəsdən ayrı saxlanılır ki, əməliyyat səs-küyü heç vaxt gələnlər qutunuza düşməsin və xəbərdarlıqlarınız bizimkilerin arxasında növbəyə durmasın.