Bir million saytni kuzatish uchun yaratilgan
Panelingiz ortida platformamiz ishlaydigan xuddi o'sha kuzatuv steklari yotadi: metrikalar uchun Prometheus va Grafana, dvigatel, ish jarayonlari va drayverlar bo'ylab taqsimlangan trassirovka uchun OpenTelemetry hamda audit ma'lumotlari alohida saqlangan holda tenant tegiga ega bo'lgan markazlashtirilgan tuzilgan loglar.
Metrikalar har bir xizmat, har bir ishchi jarayon va har bir tenant uchun, shuningdek, izolyatsiya qatlamidan olinadigan sayt bo'yicha LVE statistikasi bilan birga yig'iladi. Har bir ish jarayoni – provizioning, migratsiya, majburlash – boshidan oxirigacha ko'rinib turadi, shuning uchun qo'llab-quvvatlash xizmati taxmin qilish o'rniga aniq javob bera oladi.
Keng miqyosdagi monitoring bu ma'lumotlar hajmi muammosi, shuning uchun u shunday ishlab chiqilgan. Yuqori hajmli metrikalar har bir sayt uchun har daqiqada abadiy saqlanishi o'rniga vaqt bo'yicha bo'linadi va umumlashtiriladi, treyslar tanlab olinadi va har bir tenant kardinalligi boshqaruvi bitta shovqinli akkauntning boshqa barcha foydalanuvchilar boshqaruv panelini sekinlashtirishiga yo'l qo'ymaydi. Loyihalashtirish maqsadi bugungi kunda biz boshqarayotgan son emas, balki bir million saytdir.
Ogohlantirishlar Alertmanager orqali belgilangan va kuzatiladigan SLO'larga ega navbatchilik rotatsiyamizga yo'naltiriladi — yuqoridagi mijoz bildirishnomalaridan ataylab alohida saqlanadi, shunda operatsion shovqin hech qachon qutingizga tushmaydi va ogohlantirishlaringiz biznikidan keyin navbatda turmaydi.