ஒரு மில்லியன் தளங்களைக் கண்காணிக்க உருவாக்கப்பட்டது
உங்கள் டாஷ்போர்டின் பின்னணியில், நாங்கள் இயங்குதளத்தை இயக்கும் அதே கண்காணிப்பு ஸ்டாக் உள்ளது: மெட்ரிகளுக்கு Prometheus மற்றும் Grafana, எஞ்சின், வொர்க்ஃப்ளோக்கள் மற்றும் டிரைவர்கள் முழுவதும் விநியோகிக்கப்பட்ட ட்ரேசிங்கிற்கு OpenTelemetry, மற்றும் தணிக்கைத் தரவு தனித்தனியாக வைக்கப்பட்டு டெனன்ட்-டேக் செய்யப்பட்ட மையப்படுத்தப்பட்ட கட்டமைக்கப்பட்ட பதிவுகள்.
ஒ hஒ சேவையின் அடிப்படையில், ஒவ்வொரு பணியாளர் மற்றும் ஒவ்வொரு வாடிக்கையாளருக்கும் அளவீடுகள் சேகரிக்கப்படுகின்றன, மேலும் தனிமைப்படுத்தப்பட்ட அடுக்கிலிருந்து ஒவ்வொரு தளத்திற்கான LVE புள்ளிவிவரங்களும் பெறப்படுகின்றன. ஒவ்வொரு பணிப்பாய்வு இயக்கமும் - ஒதுக்கீடு, இடம்பெயர்வு, அமலாக்கம் - தொடக்கம் முதல் முடிவு வரை தெரியும், அதனால்தான் ஒரு ஆதரவுப் பதிலானது யூகமாக இல்லாமல் துல்லியமாக இருக்க முடியும்.
பெரிய அளவிலான கண்காணிப்பு என்பது ஒரு தரவு-அளவுச் சிக்கலாகும், எனவே அது அதற்கேற்பவே வடிவமைக்கப்பட்டுள்ளது. அதிக அளவு அளவீடுகள் ஒவ்வொரு தளத்திற்கும் நிமிடத்திற்கு என்ற கணக்கில் எப்போதும் வைக்கப்படுவதற்குப் பதிலாக, நேரத்தின் அடிப்படையில் பிரிக்கப்பட்டு தொகுக்கப்படுகின்றன, சுவடுகள் மாதிரி எடுக்கப்படுகின்றன, மேலும் ஒரு வாடிக்கையாளருக்கான கார்டினாலிட்டி கட்டுப்பாடுகள் ஒரு சத்தமான கணக்கு மற்ற அனைவரின் டேஷ்போர்டுகளையும் சீரழிப்பதைத் தடுக்கின்றன. வடிவமைப்பு இலக்கு ஒரு மில்லியன் தளங்கள் ஆகும், இன்று நாம் இயக்கும் எண்ணிக்கை அல்ல.
எச்சரிக்கைகள் அனைத்தும் அலர்ட்மேனேஜர் (Alertmanager) மூலம் எங்களது ஆன்-கால் சுழற்சிக்கு (on-call rota) அனுப்பப்படுகின்றன; மேலும் இதற்கான எஸ்.எல்.ஓ-க்கள் (SLOs) வரையறுக்கப்பட்டு கண்காணிக்கப்படுகின்றன. இது மேலே குறிப்பிடப்பட்டுள்ள வாடிக்கையாளர் அறிவிப்புகளிலிருந்து வேண்டுமென்றே தனித்தனியாக வைக்கப்பட்டுள்ளது. இதன் மூலம், செயல்பாட்டுச் சத்தங்கள் (operational noise) எப்போதுமே உங்கள் இன்பாக்ஸுக்கு வராது, மேலும் உங்கள் எச்சரிக்கைகள் எங்களது எச்சரிக்கைகளுக்குப் பின்னால் வரிசையில் நிற்காது.