ສ້າງຂຶ້ນມາເພື່ອຕິດຕາມເວັບໄຊນັບລ້ານແຫ່ງ
ຢູ່ເບື້ອງຫຼັງແດຊບອດຂອງທ່ານແມ່ນ observability stack ດຽວກັນກັບທີ່ພວກເຮົາໃຊ້ດໍາເນີນການແພລດຟອມ: Prometheus ແລະ Grafana ສໍາລັບຕົວຊີ້ວັດ (metrics), OpenTelemetry ສໍາລັບ distributed tracing ຂ້າມ engine, ລະບົບການທໍາງານ (workflows) ແລະ ໄດຣເວີ, ພ້ອມທັງ log ທີ່ມີໂຄງສ້າງແບບລວມສູນ ເຊິ່ງຖືກຕິດແທັກ tenant ໂດຍແຍກຂໍ້ມູນການກວດສອບ (audit data) ໄວ້ຕ່າງຫາກ.
ມາດຕິກາແມ່ນຖືກເກັບຮັກສາຕາມແຕ່ລະບໍລິການ, ຕາມແຕ່ລະຜູ້ເຮັດວຽກ ແລະ ຕາມແຕ່ລະຜູ້ເຊົ່າ, ພ້ອມກັບສະຖິຕິ LVE ຕາມແຕ່ລະເວັບໄຊຈາກຊັ້ນການແຍກຕ່າງຫາກ. ທຸກໆການດຳເນີນງານຂອງຂັ້ນຕອນການເຮັດວຽກ — ການຈັດສັນ, ການຍ້າຍຂໍ້ມູນ, ການບັງຄັບໃຊ້ — ແມ່າມັກຈະເຫັນໄດ້ຕັ້ງແຕ່ຕົ້ນຈົນຈົບ, ຍ້ອນແນວນັ້ນ ຄຳຕອບຈາກຝ່າຍຊ່ວຍເຫຼືອຈຶ່ງສາມາດລະບຸຢ່າງຈະແຈ້ງໄດ້ ແທນທີ່ຈະເປັນການຄາດເດົາ.
ການຕິດຕາມກວດກາໃນຂະໜາດໃຫຍ່ແມ່ນບັນຫາປະລິມານຂໍ້ມູນ, ດັ່ງນັ້ນຈຶ່ງຖືກອອກແບບມາເປັນແບບນັ້ນ. ມຽນວັດແທກປະລິມານສູງຈະຖືກແບ່ງປັນຕາມເວລາ ແລະ ສະຫຼຸບລວມ thay vì ເກັບຮັກສາໄວ້ຕໍ່ເວັບໄຊຕໍ່ນາທີຕະຫຼອດໄປ, ເສັ້ນທາງການເຮັດວຽກຈະຖືກຸ່ມຕົວຢ່າງ, ແລະ ການຄວບຄຸມຄ່າຄວາມຫຼາກຫຼາຍຕໍ່ຜູ້ເຊົ່າຈະປ້ອງກັນບໍ່ໃຫ້ບັນຊີທີ່ມີສຽງລົບກວນໜຶ່ງສົ່ງຜົນກະທົບຕໍ່ໜ້າຈໍສະແດງຜົນຂອງຄົນອື່ນ. ເປົ້າໝາຍການອອກແບບແມ່ນໜຶ່ງລ້ານເວັບໄຊ, ບໍ່ແມ່ນຈຳນວນທີ່ພວກເຮົາດຳເນີນງານໃນມື້ນີ້.
ການແຈ້ງເຕືອນແມ່ນຖືກສົ່ງຜ່ານ Alertmanager ໄປຫາລາຍຊື່ຜູ້ປະຈໍາການຂອງພວກເຮົາໂດຍມີ SLOs ທີ່ຖືກກໍານົດ ແລະຕິດຕາມໄວ້ — ເຊິ່ງຖືກແຍກອອກຈາກການແຈ້ງເຕືອນລູກຄ້າດ້ານເທິງຢ່າງຕັ້ງໃຈ, ເພື່ອບໍ່ໃຫ້ສຽງລົບກວນໃນການປະຕິບັດງານເຂົ້າໄປໃນອິນບັອກຂອງທ່ານ ແລະການແຈ້ງເຕືອນຂອງທ່ານຈະບໍ່ຖືກເຂົ້າຄິວຕໍ່ຈາກຂອງພວກເຮົາ.