6.0

6.0 भाग 6 का परिचय: विश्वसनीयता, संचालन, और सुरक्षा मेट्रिक्स

भाग 2 ने कवर किया कि एक परिवर्तन एक कमिट से उत्पादन तक कैसे पहुँचता है; यह भाग कवर करता है कि एक बार यह वहाँ चलने के बाद क्या होता है, अनिश्चित काल तक, वास्तविक स्थितियों के तहत जिन्हें टीम पूरी तरह नियंत्रित नहीं कर सकती। विश्वसनीयता, संचालन, और सुरक्षा मेट्रिक्स वे हैं जहाँ सॉफ़्टवेयर इंजीनियरिंग के वादे निरंतर वास्तविकता से मिलते हैं: “क्या यह डिप्लॉय सफल हुआ” नहीं बल्कि “क्या यह प्रणाली रात-दर-रात, भार के तहत, हमले के तहत, और एक ऑन-कॉल रोटेशन के तनाव के तहत काम करना जारी रखती है जिसे केवल अगली घटना के लिए नहीं बल्कि वर्षों के लिए टिकाऊ होना चाहिए।”

इस भाग के चार विषय एक जान-बूझकर बनाई गई चाप का अनुसरण करते हैं। सेवा स्तर संकेतक और लक्ष्य (विषय 6.1) उस शब्दावली और लक्ष्य-निर्धारण अनुशासन को स्थापित करते हैं जिस पर इस भाग में बाक़ी सब कुछ निर्भर करता है। घटना मेट्रिक्स (विषय 6.2) मापते हैं कि जब वह लक्ष्य चूक जाता है तो क्या होता है। ऑन-कॉल और क्षमता मेट्रिक्स (विषय 6.3) लक्ष्य को पूरा रखने की मानवीय और अवसंरचना लागत मापते हैं। सुरक्षा और भेद्यता मेट्रिक्स (विषय 6.4) उसी विश्वसनीयता अनुशासन को एक अलग लेकिन निकटता से संबंधित जोखिम तक विस्तारित करते हैं: “क्या यह अपने आप विफल होगा” नहीं बल्कि “क्या कोई इसे जान-बूझकर विफल करेगा।” चारों विषय इस पुस्तक के केंद्रीय अनुशासन को साझा करते हैं: मेट्रिक को नाम दें, इसके साथ कैसे चालाकी की जाती है यह नाम दें, और इसे उस गार्डरेल के साथ जोड़ें जो उस चालाकी को पकड़ता है।

बड़ी टीमों के लिए, यह भाग के मेट्रिक्स वे हैं जहाँ इंजीनियरिंग के वादे संविदात्मक और, सरकारी संदर्भों में, कभी-कभी क़ानूनी बन जाते हैं। एंटरप्राइज़ संगठन विषय 6.1 द्वारा पेश किए गए मेट्रिक्स के विरुद्ध सेवा स्तर समझौते लिखते हैं, जिनमें उन्हें चूकने पर वास्तविक वित्तीय दंड होते हैं; सरकारी संगठन महत्वपूर्ण सार्वजनिक अवसंरचना चलाते हैं जहाँ एक विश्वसनीयता या सुरक्षा विफलता एक अकेली कंपनी की बैलेंस शीट से कहीं परे परिणाम रखती है। यह भाग पूरी तरह उस भार को गंभीरता से मानता है।

इस भाग के विषय

  • 6.1 सेवा स्तर संकेतक, लक्ष्य, और त्रुटि बजट: वह शब्दावली और लक्ष्य-निर्धारण अनुशासन जो साइट विश्वसनीयता इंजीनियरिंग के पूरे आधार में है, और एक त्रुटि बजट विश्वसनीयता को एक अप्राप्य निरपेक्षता की बजाय एक ख़र्च करने योग्य, प्रबंधनीय संसाधन में कैसे बदलता है।
  • 6.2 घटना मेट्रिक्स: पहचान, प्रतिक्रिया, और रिकवरी: यह मापना कि एक संगठन कितनी जल्दी एक विफलता को नोटिस करता है, उस पर प्रतिक्रिया देता है, और इसे हल करता है, और वह दोषरहित अनुशासन जो उस माप को ईमानदार रखता है।
  • 6.3 ऑन-कॉल, क्षमता, और परिचालन भार मेट्रिक्स: विश्वसनीयता बनाए रखने की मानवीय और अवसंरचना लागत, और क्यों एक अस्थिर ऑन-कॉल बोझ अंततः स्वयं एक विश्वसनीयता समस्या के रूप में सामने आता है।
  • 6.4 सुरक्षा और भेद्यता प्रबंधन मेट्रिक्स: उसी अनुशासित, गार्डरेल-युग्मित दृष्टिकोण को सुरक्षा जोखिम तक विस्तारित करना, भेद्यता खोज से उपचार तक।

ये विषय आपस में कैसे संबंधित हैं

विषय 6.1 वह आधार निर्धारित करता है जिस पर इस भाग का हर बाद का विषय बनता है: एक स्पष्ट सेवा स्तर लक्ष्य के बिना, “यह घटना कितनी बुरी थी” (विषय 6.2) और “क्या हमारा ऑन-कॉल भार टिकाऊ है” (विषय 6.3) के मापने के विरुद्ध कोई साझा संदर्भ बिंदु नहीं है। विषय 6.2 के घटना मेट्रिक्स, एक वास्तविक अर्थ में, विषय 6.1 द्वारा पेश किए गए त्रुटि-बजट ख़र्च का रिकॉर्ड हैं; विषय 6.3 उस मानवीय प्रणाली की टिकाऊपन मापता है जो उस ख़र्च को बजट के भीतर रखने के लिए ज़िम्मेदार है; और विषय 6.4 उसी लक्ष्य-और-बजट सोच को एक सुरक्षा मुद्रा पर लागू करता है जो, अनमापा छोड़ा जाने पर, केवल प्रतिक्रियात्मक रूप से ध्यान प्राप्त करती है, एक घटना के बाद, सक्रिय रूप से नहीं।

यह भाग सीधे भाग 2 से वापस जुड़ता है: DORA की चेंज फ़ेल्योर रेट और विफल डिप्लॉयमेंट रिकवरी टाइम (दोनों विषय 2.10 में कवर किए गए) क्रमशः इस भाग के घटना मेट्रिक्स के लिए एक अग्रणी संकेतक और एक उदाहरण हैं। यह भाग 8 से भी आगे जुड़ता है, जहाँ डैशबोर्ड और कार्यक्रम-परिपक्वता मार्गदर्शन एक अमूर्त लक्ष्य (विश्वसनीयता, सुरक्षा) को एक ठोस, ट्रैक करने योग्य, ग़ैर-निरपेक्ष लक्ष्य में बदलने के एक काम किए गए उदाहरण के रूप में इस भाग के त्रुटि-बजट मॉडल पर भारी रूप से निर्भर करता है जिसे एक टीम वास्तव में दिन-प्रतिदिन प्रबंधित कर सकती है।