د یو ملیون سایټونو د څار لپاره جوړ شوی
د ستاسو ډشبورډ تر شا هغه ورته د لید وړتیا سټک (observability stack) دی چې موږ پرې پلتفورم چلوو: د میټریکونو لپاره Prometheus او Grafana، د انګن، کاري بهیرونو او ډرایو په اوږدو کې د ویشل شوي تعقیب لپاره OpenTelemetry، او متمرکز جوړښت لرونکي لاګونه چې د کرایه کونکي په نښه شوي دي او د پلټنې ډیټا په جلا توګه ساتل کیږي.
میټریکونه د هر خدمت، هر کارګر او هر کرایه کونکي لپاره د انزوا پرت څخه د هر سایټ LVE احصایو سره راټول شوي. د کاري جریان هره پروسه — چمتو کول، مهاجرت، پلي کول — له پای تر پایه د لیدلو وړ دي، له همدې امله د ملاتړ ځواب د اټکل پر ځای مشخص کیدی شي.
په لویه کچه څارنه د ډاټا د حجم یوه ستونزه ده، نو دا هم د همدې په توګه ډیزاین شوې ده. د لوړ حجم میټریکونه د تل لپاره د هر سایټ او دقیقې پر ځای په وخت ویشل کیږي او یو ځای کیږي، ټریسونه نمونه کیږي، او د هر ټیننټ د کارډینالټي کنټرولونه د دې مخه نیسي چې یو شورماشور لرونکی اکاونټ د نورو ټولو ډشبورډونه خراب کړي. د ډیزاین موخه یو ملیون سایټونه دي، نه هغه شمیر چې موږ یې نن چلوو.
خبرتیاوې د Alertmanager له لارې زموږ د ان کال (on-call) روټا ته د تعریف شویو او تعقیب شویو SLOs سره استول کیږي — کوم چې د پورتنیو پېرودونکو خبرتیاو څخه په قصدي توګه جلا ساتل شوي، ترڅو عملیاتي شور هکله ستاسو ان باکس ته ونه رسېږي او ستاسو خبرتیاوې زموږ د خبرتیاو تر شا په قطار کې ونه درېږي.