Napravljeno za praćenje milijun web-mjesta
Iza vaše nadzorne ploče nalazi se isti sustav za promatranje na kojem pokrećemo platformu: Prometheus i Grafana za metrike, OpenTelemetry za distribuirano praćenje kroz mehanizam, tijekove rada i upravljačke programe, te centralizirani strukturirani dnevnici označeni oznakom zakupca s podacima revizije koji se čuvaju odvojeno.
Metrike se prikupljaju po usluzi, po radnom procesu i po klijentu, uz LVE statistiku po web-mjestu iz izolacijskog sloja. Svako izvršavanje radnog procesa — provizioniranje, migracija, primjena — vidljivo je od kraja do kraja, zbog čega odgovor podrške može biti konkretan umjesto nagađanja.
Praćenje velikih razmjera zapravo je problem količine podataka, pa je tako i konstruirano. Metrike velike količine podataka vremenski su podijeljene i sažete umjesto da se zauvijek čuvaju po web-mjestu i po minuti, tragovi se uzorkuju, a kontrole kardinalnosti po korisniku sprječavaju da jedan bučan račun narušava nadzorne ploče svih ostalih. Cilj dizajna je milijun web-mjesta, a ne broj koji pokrećemo danas.
Uzbunjivanje se usmjerava putem Alertmanagera u naš raspored dežurstava s definiranim i praćenim SLO-ovima – namjerno odvojenim od gornjih obavijesti za korisnike, tako da operativna buka nikada ne dospije u vaš pretinac e-pošte, a vaši se alarmi nikada ne redaju iza naših.