ਇੱਕ ਮਿਲੀਅਨ ਸਾਈਟਾਂ ਦੀ ਨਿਗਰਾਨੀ ਕਰਨ ਲਈ ਬਣਾਇਆ ਗਿਆ ਹੈ
ਤੁਹਾਡੇ ਡੈਸ਼ਬੋਰਡ ਦੇ ਪਿੱਛੇ ਉਹੀ ਔਬਜ਼ਰਵੇਬਿਲਟੀ ਸਟੈਕ ਹੈ ਜਿਸ 'ਤੇ ਅਸੀਂ ਪਲੇਟਫਾਰਮ ਚਲਾਉਂਦੇ ਹਾਂ: ਮੈਟ੍ਰਿਕਸ ਲਈ Prometheus ਅਤੇ Grafana, ਇੰਜਣ, ਵਰਕਫਲੋ ਅਤੇ ਡਰਾਈਵਰਾਂ ਵਿੱਚ ਵੰਡੇ ਗਏ ਟਰੇਸਿੰਗ ਲਈ OpenTelemetry, ਅਤੇ ਕੇਂਦਰੀਕ੍ਰਿਤ ਸਟ੍ਰਕਚਰਡ ਲੌਗਸ ਜੋ ਕਿ ਕਿਰਾਏਦਾਰ-ਟੈਗ ਕੀਤੇ ਗਏ ਹਨ ਅਤੇ ਆਡਿਟ ਡੇਟਾ ਨੂੰ ਵੱਖਰਾ ਰੱਖਿਆ ਗਿਆ ਹੈ।
ਮੀਟ੍ਰਿਕਸ ਪ੍ਰਤੀ ਸਰਵਿਸ, ਪ੍ਰਤੀ ਵਰਕਰ ਅਤੇ ਪ੍ਰਤੀ ਟੈਨੈਂਟ ਇਕੱਠੇ ਕੀਤੇ ਜਾਂਦੇ ਹਨ, ਆਈਸੋਲੇਸ਼ਨ ਲੇਅਰ ਤੋਂ ਪ੍ਰਤੀ-ਸਾਈਟ LVE ਅੰਕੜਿਆਂ ਦੇ ਨਾਲ। ਹਰ ਵਰਕਫਲੋ ਰਨ — ਪ੍ਰੋਵਿਜ਼ਨਿੰਗ, ਮਾਈਗ੍ਰੇਸ਼ਨ, ਐਨਫੋਰਸਮੈਂਟ — ਸ਼ੁਰੂ ਤੋਂ ਅੰਤ ਤੱਕ ਦਿਖਾਈ ਦਿੰਦਾ ਹੈ, ਇਸੇ ਕਰਕੇ ਸਪੋਰਟ ਦਾ ਜਵਾਬ ਅੰਦਾਜ਼ੇ ਦੀ ਬਜਾਏ ਨਿਸ਼ਚਿਤ ਹੋ ਸਕਦਾ ਹੈ।
ਵੱਡੇ ਪੈਮਾਨੇ 'ਤੇ ਨਿਗਰਾਨੀ ਇੱਕ ਡਾਟਾ-ਵਾਲੀਅਮ ਦੀ ਸਮੱਸਿਆ ਹੈ, ਇਸ ਲਈ ਇਸਨੂੰ ਉਸੇ ਤਰ੍ਹਾਂ ਤਿਆਰ ਕੀਤਾ ਗਿਆ ਹੈ। ਵੱਡੀ ਮਾਤਰਾ ਵਾਲੇ ਮੈਟ੍ਰਿਕਸ ਨੂੰ ਹਰੇਕ ਸਾਈਟ ਲਈ ਪ੍ਰਤੀ ਮਿੰਟ ਹਮੇਸ਼ਾ ਰੱਖਣ ਦੀ ਬਜਾਏ ਸਮਾਂ-ਵੰਡਿਆ ਅਤੇ ਇਕੱਠਾ ਕੀਤਾ ਜਾਂਦਾ ਹੈ, ਟ੍ਰੇਸਾਂ ਦਾ ਨਮੂਨਾ ਲਿਆ ਜਾਂਦਾ ਹੈ, ਅਤੇ ਪ੍ਰਤੀ-ਕਿਰਾਏਦਾਰ ਕਾਰਡੀਨੈਲਿਟੀ ਕੰਟਰੋਲ ਕਿਸੇ ਇੱਕ ਰੌਲੇ-ਰੱਪੇ ਵਾਲੇ ਖਾਤੇ ਨੂੰ ਬਾਕੀ ਸਾਰਿਆਂ ਦੇ ਡੈਸ਼ਬੋਰਡਾਂ ਨੂੰ ਪ੍ਰਭਾਵਿਤ ਕਰਨ ਤੋਂ ਰੋਕਦੇ ਹਨ। ਡਿਜ਼ਾਈਨ ਦਾ ਟੀਚਾ ਇੱਕ ਮਿਲੀਅਨ ਸਾਈਟਾਂ ਹੈ, ਨਾ ਕਿ ਉਹ ਸੰਖਿਆ ਜੋ ਅਸੀਂ ਅੱਜ ਚਲਾਉਂਦੇ ਹਾਂ।
ਅਲਰਟਿੰਗ ਨੂੰ Alertmanager ਰਾਹੀਂ ਸਾਡੇ ਆਨ-ਕਾਲ ਰੋਟਾ 'ਤੇ ਪਰਿਭਾਸ਼ਿਤ ਅਤੇ ਟ੍ਰੈਕ ਕੀਤੇ SLOs ਨਾਲ ਰੂਟ ਕੀਤਾ ਜਾਂਦਾ ਹੈ — ਇਸਨੂੰ ਉੱਪਰ ਦਿੱਤੀਆਂ ਗਾਹਕ ਸੂਚਨਾਵਾਂ ਤੋਂ ਜਾਣਬੁੱਝ ਕੇ ਵੱਖਰਾ ਰੱਖਿਆ ਗਿਆ ਹੈ, ਤਾਂ ਜੋ ਅਪ੍ਰੇਸ਼ਨਲ ਰੌਲਾ-ਰੱਪਾ ਕਦੇ ਵੀ ਤੁਹਾਡੇ ਇਨਬਾਕਸ ਵਿੱਚ ਨਾ ਪਹੁੰਚੇ ਅਤੇ ਤੁਹਾਡੇ ਅਲਰਟ ਕਦੇ ਵੀ ਸਾਡੇ ਅਲਰਟਾਂ ਦੇ ਪਿੱਛੇ ਕਤਾਰ ਵਿੱਚ ਨਾ ਲੱਗਣ।