បង្កើតឡើងដើម្បីមើលគេហទំព័រមួយលាន
ខាងក្រោយផ្ទាំងគ្រប់គ្រងរបស់អ្នកគឺជាប្រព័ន្ធ observability ដូចគ្នាដែលយើងដំណើរការលើវេទិកានេះ៖ Prometheus និង Grafana សម្រាប់រង្វាស់, OpenTelemetry សម្រាប់ distributed tracing ទូទាំងម៉ាស៊ីន, workflows និង drivers និង centralised structured logs ដែលត្រូវបានដាក់ស្លាកតាម tenant ជាមួយនឹងទិន្នន័យ audit រក្សាទុកដោយឡែកពីគ្នា។
រង្វាស់ម៉ាទ្រីសត្រូវបានប្រមូលតាមសេវាកម្ម តាមកម្មករ និងតាមអ្នកជួល ដោយមានស្ថិតិ LVE តាមគេហទំព័រពីស្រទាប់អ៊ីសូឡង់។ រាល់ដំណើរការការងារទាំងអស់ — ការរៀបចំ ការផ្ទេរ ការអនុវត្ត — គឺអាចមើលឃើញពីដើមដល់ចប់ ដែលជាមូលហេតុធ្វើឱ្យចម្លើយគាំទ្រអាចមានលក្ខណៈជាក់លាក់ជំនួសឱ្យការស្មាន។
ការតាមដានក្នុងទ្រង់ទ្រាយធំគឺជាបញ្ហាពាក់ព័ន្ធនឹងទំហំទិន្នន័យ ដូច្នេះវាត្រូវបានរចនាឡើងដើម្បីដោះស្រាយបញ្ហានេះ។ រ៉ែមាសដែលមានទំហំធំត្រូវបានបែងចែកតាមពេលវេលា និងបូកសរុបបញ្ចូលគ្នា ជាជាងការរក្សាទុកតាមគេហទំព័រនីមួយៗ និងតាមនាទីជារៀងរហូត ឯ traces ត្រូវបានទាញយកជាគំរូ ហើយការគ្រប់គ្រងកម្រិត cardinality តាមអ្នកប្រើប្រាស់នីមួយៗគឺដើម្បីទប់ស្កាត់គណនីដែលប្រើប្រាស់ច្រើនមិនឱ្យប៉ះពាល់ដល់ផ្ទាំងបញ្ជារបស់អ្នកផ្សេងទៀត។ គោលដៅនៃការរចនាគឺសម្រាប់គេហទំព័រមួយលាន មិនមែនត្រឹមតែចំនួនដែលយើងកំពុងដំណើរការនៅថ្ងៃនេះនោះទេ។
ការជូនដំណឹងត្រូវបានបញ្ជូនតាមរយៈ Alertmanager ទៅកាន់តារាងវេនបម្រើការរបស់យើង ដោយមានកំណត់ និងតាមដាន SLOs ដែលត្រូវបានរក្សាទុកដោយចេតនាឱ្យដាច់ដោយឡែកពីការជូនដំណឹងដល់អតិថិជនខាងលើ ដើម្បីធានាថាកកស្ទះសំឡេងប្រតិបត្តិការមិនធ្លាក់ចូលក្នុងប្រអប់សំបុត្ររបស់អ្នក និងការជូនដំណឹងរបស់អ្នកមិនត្រូវតម្រៀបរង់ចាំពីក្រោយរបស់យើងឡើយ។