ایک ملین سائٹس کی نگرانی کے لیے بنایا گیا
آپ کے ڈیش بورڈ کے پیچھے وہی ابزرویبلٹی اسٹیک ہے جس پر ہم پلیٹ فارم چلاتے ہیں: میٹرکس کے لیے Prometheus اور Grafana، انجن، ورک فلو اور ڈرائیورز میں ڈسٹری بیوٹڈ ٹریسنگ کے لیے OpenTelemetry، اور الگ رکھے گئے آڈٹ ڈیٹا کے ساتھ ٹیننٹ ٹیگ شدہ سینٹرلائزڈ سٹرکچرڈ لاگز۔
میٹرکس فی سروس، فی ورکر اور فی ٹیننٹ جمع کیے جاتے ہیں، جن میں آئسولیشن لیئرز سے حاصل کردہ فی سائٹ LVE کے اعداد و شمار بھی شامل ہیں۔ ورک فلو کا ہر رَن — پروویژننگ، مائیگریشن، انفورسمنٹ — شروع سے آخر تک نظر آتا ہے، یہی وجہ ہے کہ سپورٹ کا جواب اندازے کے بجائے بالکل درست ہو سکتا ہے۔
بڑے پیمانے پر مانیٹرنگ اصل میں ڈیٹا کے حجم کا مسئلہ ہے، اس لیے اسے اسی حساب سے ڈیزائن کیا گیا ہے۔ اعلیٰ حجم کی میٹرکس کو ہمیشہ کے لیے فی سائٹ فی منٹ محفوظ رکھنے کے بجائے وقت کے لحاظ سے تقسیم اور یکجا (rolled up) کیا جاتا ہے، ٹریسز کا نمونہ (sample) لیا جاتا ہے، اور فی ٹیننٹ کارڈینیلٹی کنٹرولز کسی ایک زیادہ شور مچانے والے اکاؤنٹ کو دوسروں کے ڈیش بورڈز کو خراب کرنے سے روکتے ہیں۔ ڈیزائن کا ہدف دس لاکھ سائٹس ہیں، نہ کہ وہ تعداد جو ہم آج چلا رہے ہیں۔
الرٹنگ کو الرٹ مینیجر کے ذریعے ہمارے آن کال روٹا پر بھیجا جاتا ہے جس میں ایس ایل او کی تعریف اور ٹریکنگ کی جاتی ہے — اسے جان بوجھ کر اوپر والے کسٹمر نوٹیفیکیشنز سے الگ رکھا گیا ہے، تاکہ آپریشنل شور کبھی آپ کے ان باکس میں نہ آئے اور آپ کے الرٹس ہمارے الرٹس کے پیچھے قطار میں نہ لگیں۔