क्षेत्र समूह और बाज़ार श्रेणियाँ अक्सर एक ही स्तंभ में रख दिए जाते हैं, क्योंकि दोनों देशों को टोकरियों में बाँटने के तरीके हैं। वे अलग दिशाओं से आते हैं, अलग कारणों से बदलते हैं, और उन्हें अलग पाठक पढ़ते हैं; इसलिए जो अकेली फ़ील्ड दोनों को रखने की कोशिश करती है, वह अंततः किसी की नहीं रहती।
यह लेख दोनों को अलग करता है। यह बताता है कि समूह कहाँ से आते हैं, बाज़ार श्रेणी एक व्यावसायिक निर्णय क्यों है जिसका प्रारूप समर्थन से कोई संबंध नहीं, और ऐसा समूह कैसे रखें जिसे लिखे जाने के वर्षों बाद फिर पढ़ा जाएगा।
क्षेत्र समूह असल में कहाँ से आते हैं?
समूह परंपराएँ हैं, दुनिया के तथ्य नहीं। किसी देश के साथ उसका क्षेत्र इस तरह नहीं चलता जैसे उसके साथ समुद्रतट चलता है; किसी ने किसी उद्देश्य से तय किया कि उसे किन पड़ोसियों के साथ दर्शाया जाएगा।
इसका एक व्यावहारिक परिणाम है। दो टीमें एक ही देश के समूहन पर दोनों सही हो सकती हैं और फिर भी असहमत रह सकती हैं, क्योंकि एक रिपोर्ट के लिए समूह बना रही है और दूसरी शिपिंग दर पत्रक के लिए। असहमति तभी समस्या बनती है जब समूह एक बार संचित होता है और हर जगह वही पढ़ा जाता है, क्योंकि तब एक पाठक का उद्देश्य चुपचाप दूसरे के ऊपर भारी पड़ जाता है।
इसका उपाय एक सच्चे समूह की खोज नहीं है। उपाय यह है कि हर समूह को नाम दिया जाए — रिपोर्ट क्षेत्र, रसद क्षेत्र, सामग्री क्षेत्र — और किसी देश को हर एक में स्वतंत्र रूप से जगह मिलने दी जाए।
महाद्वीप, उपक्षेत्र और आधिकारिक क्षेत्रीय कोड
सबसे स्थिर समूह अंतरराष्ट्रीय कोडिंग व्यवस्थाओं से आते हैं। वे क्षेत्र और उपक्षेत्र परिभाषित करती हैं, और वे ठीक इसीलिए बनी हैं ताकि आँकड़ों को देशों के आर-पार जोड़ा जा सके बिना यह कि हर कोई अपनी ताक़-सज्जा खुद गढ़े।
चूँकि ये मानकों के रूप में बनाए रखी जाती हैं, ये अच्छी तरह यात्रा करती हैं। किसी आधिकारिक उपक्षेत्र पर समूहित रिपोर्ट को वह व्यक्ति भी दोहरा सकता है जिसने आपकी आंतरिक परंपराएँ कभी देखी ही नहीं। आपकी आंतरिक परंपराओं पर समूहित रिपोर्ट केवल वही पढ़ सकता है जिसने उन्हें देखा हो।
क़ीमत फ़ाइन-ग्रेनता है: मानक क्षेत्र सांख्यिकीय उद्देश्यों के लिए परिभाषित हैं, और व्यावसायिक प्रश्न अक्सर उन्हें काटते हुए चलते हैं। आधिकारिक समूहन को आधार मानें, और व्यावसायिक समूहन को उसके ऊपर एक अलग गुण के रूप में रखें, आधार को नया नाम देने के बजाय।
बाज़ार श्रेणी और प्रारूप समर्थन का कोई संबंध नहीं
बाज़ार श्रेणी प्राथमिकता का वक्तव्य है, क्षमता का नहीं। सामान्य आकार कुछ स्तरों का होता है जो ध्यान के क्रम में लगे होते हैं: शुरुआती बाज़ार, केंद्रित बाज़ार, निगरानी सूची, और बाकी। इनमें से कोई स्तर यह नहीं बताता कि उस देश का डेटा कितना पूरा है।
उलझन इसलिए पैदा होती है क्योंकि दोनों गुण स्तर जैसे लगते हैं, इसलिए उन्हें एक ही रूप में संचित कर दिया जाता है। नतीजा ऐसी व्यवस्था होती है जिसमें किसी देश की श्रेणी घटाना उसके डेटा को गिराने जैसा दिखता है, और उत्तम डेटा वाला देश जिसकी कोई वाणिज्यिक योजना नहीं है, असमर्थित फ़ाइल में पड़ जाता है।
दोनों को अलग रखें और विफलता के तरीके भी अलग रह जाएँगे। कोई देश शुरुआती बाज़ार हो सकता है और उसका डेटा पतला हो — यह डेटा की समस्या है — या निगरानी सूची का बाज़ार हो सकता है और उसका डेटा पूरा हो, जो कोई समस्या ही नहीं है।
| गुण | वक्तव्य का प्रकार | कौन तय करता है | कितनी बार बदलता है |
|---|---|---|---|
| क्षेत्र या उपक्षेत्र | कहाँ होने की परंपरा | रिपोर्टिंग या मानक निकाय | कभी-कभी, और आपसी सहमति से |
| बाज़ार श्रेणी | प्राथमिकता का निर्णय | वाणिज्यिक ज़िम्मेदार व्यक्ति | योजना चक्रों पर |
| प्रारूप समर्थन | डेटा का तथ्य | डेटा या अभियांत्रिकी ज़िम्मेदार व्यक्ति | जब डेटा बदले |
कोई आश्रित क्षेत्र किस समूह में आना चाहिए?
आश्रित क्षेत्र, विदेशी विभाग और विवादित दर्जे वाले क्षेत्र वह जगह हैं जहाँ कोई समूहन योजना सबसे अधिक गलत होने की संभावना रखती है, क्योंकि विरासत में लेने योग्य कोई स्पष्ट उत्तर नहीं होता और हर उपलब्ध उत्तर के पीछे कोई पूर्ववृत्त होता है।
काम करने वाला नियम यह है कि कसौटी को याद करने के बजाय लिख दिया जाए। क्या कोई आश्रित क्षेत्र उस राज्य के साथ समूहित होता है जो उसका प्रशासन करता है, उस भौगोलिक क्षेत्र के साथ जिसमें वह बैठता है, या अपने अलग समूह में? तीनों में से कोई भी सही हो सकता है; कोई भी स्वतः स्पष्ट नहीं है, और छह महीने बाद नियम लागू करने वाला व्यक्ति उसे डेटा से दोबारा नहीं बना पाएगा।
कसौटी बन जाने के बाद उसे कोडिंग परत में भी एकरूपता से लागू करना होता है। इस बात की जानकारी कि कोड व्यवस्थाएँ इन इकाइयों को कैसे देखती हैं, देश और प्रभाग कोड मार्गदर्शिका में है, क्योंकि जो समूहन अपने नीचे के कोडों से टकराता है वह जोड़ाई में बार-बार अपवाद पैदा करता रहेगा।
समय के साथ समूहन खिसकते क्यों हैं
समूहन उस स्थिति की एक तस्वीर है जो चलती रहती है। बाज़ार खुलते और बंद होते हैं, नियम बदलते हैं, कोई आपूर्ति मार्ग अव्यावहारिक हो जाता है, और जो देश कभी किसी समूह का स्पष्ट सदस्य था वह अब अटपटा लगने लगता है।
दो गुण इस खिसकन को सहने योग्य बनाते हैं। समूहन विन्यास-योग्य होना चाहिए, ताकि उसे बदलने के लिए कोड बदलना न पड़े। और पुराना रिकॉर्ड खोजा जा सकना चाहिए, ताकि पिछले साल बनी रिपोर्ट यह बता सके कि उस समय वह देश किस समूह में था।
यदि समूहन को केवल जगह पर ही अधिलेखित किया जाता रहे, तो इतिहास अपठनीय हो जाता है। कोई नहीं बता सकता कि किसी ग्राफ़ का गड़्ढा असली बदलाव है या इसका परिणाम कि देश को बीच अवधि में एक समूह से दूसरे में खिसका दिया गया।
डेवलपरों के लिए: समूहन कुंजी को कोड से बाहर रखें
इस क्षेत्र की सबसे मज़बूत व्यावहारिक सलाह यह है कि समूहन को शाखा नहीं, मान बनाएँ। जिस देश-सूची में हर समूहन के लिए एक पहचानकर्ता होता है, उसे डेटा संपादित करके दोबारा समूहित किया जा सकता है; जिसमें पहचानकर्ता तभी होता है जब किसी टीम को शाखा जोड़ना याद रहा, उसे नहीं।
समूहनों को अपने-अपने स्वीकार्य मानों वाले अलग गुणों के रूप में मॉडल करें, और हर एक के साथ एक छोटी परिभाषा जोड़ें। फिर कोई भी उपभोक्ता — रिपोर्ट, रूटिंग तालिका, सामग्री योजना — अपनी ज़रूरत का समूहन चुन लेता है, बजाय उसके जो पहले संचित हुआ था उसे विरासत में लेने के।
परिभाषाएँ मानों के पास रखें, और इतनी छोटी रखें कि पढ़ी जा सकें। जब कोई पूछे कि किसी श्रेणी का अर्थ क्या है, तो उत्तर उसी सामग्री में होना चाहिए जिसमें श्रेणी स्वयं है। देश और क्षेत्र निर्देशिका दिखाती है कि किसी निर्देशिका को क्षेत्र के अनुसार कैसे व्यवस्थित किया जा सकता है और फिर भी हर देश अलग से पहुँचने योग्य रहता है, जो यही अलगाव एक स्तर नीचे लागू करने जैसा है।
ऊपर जो कुछ नाम लिया गया है वह उदाहरण है। इस लेख में दिए समूह नाम, श्रेणी नाम और देशों की जगहें एक मॉडलिंग चुनाव समझाने के लिए चुने गए काल्पनिक उदाहरण हैं; वे किसी वास्तविक कंपनी की बाज़ार योजना और किसी वास्तविक रिपोर्टिंग योजना का वर्णन नहीं करते, और उन्हें वैसा नहीं पढ़ा जाना चाहिए।
आगे के कदम
अपने सिस्टम में हर वह जगह सूचीबद्ध करें जहाँ देशों को समूहित किया जाता है, और देखें कि क्या वे सब एक ही उद्देश्य के लिए एक ही गुण का उपयोग कर रही हैं। जहाँ नहीं कर रही, वहाँ उस गुण में कोई नया मान जोड़ने से पहले उसे बाँटें। सीमा पार पता परिदृश्यों की मार्गदर्शिका दिखाती है कि जब एक ही लेन-देन में कई देश-गुणों को सहमत होना पड़े तो क्या होता है, और परीक्षण डेटा के लिए देश चुनने की मार्गदर्शिका बताती है कि नीचे का देश-सेट चुना कैसे जाता है। ये दोनों यहाँ उपलब्ध हैं: सीमा पार पता परिदृश्य और परीक्षण डेटा के लिए देश चुनना।