विचरण की गणना कैसे करें
विचरण एक सांख्यिकीय माप है जो डेटा सेट में फैलाव की मात्रा को दर्शाता है। यह इंगित करता है कि व्यक्तिगत डेटा बिंदु डेटा सेट के माध्य (औसत मान) से कितना विचलित होते हैं। सांख्यिकीय विश्लेषण के लिए विचरण को समझना अत्यंत महत्वपूर्ण है, क्योंकि यह डेटा सेट की स्थिरता और विश्वसनीयता को प्रकट कर सकता है। चाहे आप छात्र हों, शोधकर्ता हों या डेटा विश्लेषक हों, विचरण की अवधारणा को समझना और इसकी गणना करना जानना आवश्यक है। यह लेख आपको विचरण क्या है, इसका महत्व और नमूने और जनसंख्या दोनों के लिए विचरण की गणना करने की चरण-दर-चरण प्रक्रिया के बारे में बताता है।
भिन्नता को समझना
शुरुआत करने के लिए, आइए विचरण से संबंधित कुछ आवश्यक शब्दों को परिभाषित करें:
– माध्य (μ या x̄): डेटा बिंदुओं का औसत।
– विचलन: प्रत्येक डेटा बिंदु और माध्य के बीच का अंतर।
– वर्ग विचलन: ऋणात्मक मानों को समाप्त करने के लिए प्रत्येक डेटा बिंदु के विचलन का वर्ग किया जाता है।
– विचरण (σ² या s²): इन वर्ग विचलनों का औसत।
विचरण का महत्व
सांख्यिकी में विचरण कई उद्देश्यों को पूरा करता है:
1. फैलाव का सूचक: जबकि माध्य एक केंद्रीय आंकड़ा प्रदान करता है, विचरण यह दर्शाता है कि संख्याएँ माध्य के आसपास कितनी फैली हुई हैं।
2. जोखिम मूल्यांकन: वित्त में, उच्च विचरण अक्सर उच्च जोखिम को दर्शाता है क्योंकि परिसंपत्ति रिटर्न अधिक फैला हुआ होता है।
3. गुणवत्ता नियंत्रण: विनिर्माण में, उत्पादों की गुणवत्ता सुनिश्चित करने के लिए भिन्नता का उपयोग किया जाता है, ताकि स्थिरता की निगरानी की जा सके।
4. परिकल्पना परीक्षण: प्रसरण विभिन्न सांख्यिकीय परीक्षणों, जैसे कि टी-परीक्षण और एनोवा में एक प्रमुख घटक है।
किसी जनसंख्या के लिए विचरण की गणना करना
जब आप डेटा के एक पूर्ण सेट से निपट रहे होते हैं, तो आप जनसंख्या विचरण की गणना कर रहे होते हैं।
जनसंख्या विचरण की गणना करने के चरण:
1. माध्य ज्ञात कीजिए: सभी डेटा बिंदुओं को जोड़ें और डेटा बिंदुओं की संख्या से भाग दें।
2. विचलन की गणना करें: विचलन प्राप्त करने के लिए प्रत्येक डेटा बिंदु से माध्य घटाएँ।
3. विचलनों का वर्ग करें: सभी मानों को धनात्मक बनाने के लिए प्रत्येक विचलन का वर्ग करें।
4. वर्ग विचलनों का योग: सभी वर्ग विचलनों को एक साथ जोड़ें।
5. विचरण की गणना करें: कुल योग को डेटा बिंदुओं की संख्या (N) से विभाजित करें।
सूत्र:
[ σ² = √(x_i – μ)²/N)
उदाहरण:
डेटा सेट [2, 4, 4, 4, 5, 5, 7, 9] पर विचार करें।
- माध्य (μ) = (2+4+4+4+5+5+7+9) / 8 = 5
– विचलन: [2-5, 4-5, 4-5, 4-5, 5-5, 5-5, 7-5, 9-5] = [-3, -1, -1, -1, 0, 0, 2, 4]
– वर्ग विचलन: [9, 1, 1, 1, 0, 0, 4, 16]
– वर्ग विचलनों का योग: 9+1+1+1+0+0+4+16 = 32
– विचरण (σ²) = 32 / 8 = 4
नमूने के लिए विचरण की गणना
जब आपके पास किसी बड़ी आबादी से डेटा का एक उपसमूह होता है, तो आप नमूना विचरण से निपट रहे होते हैं। सूत्र, नमूने द्वारा संपूर्ण आबादी के प्रतिनिधित्व को समायोजित करने के लिए, \( N \) के स्थान पर \( N-1 \) का उपयोग करता है।
नमूना विचरण की गणना करने के चरण:
1. नमूना माध्य ज्ञात कीजिए: सभी नमूना डेटा बिंदुओं को जोड़ें और नमूना बिंदुओं की संख्या से भाग दें।
2. विचलन की गणना करें: प्रत्येक डेटा बिंदु से नमूना माध्य घटाएँ।
3. विचलनों का वर्ग करें: प्रत्येक विचलन का वर्ग करें।
4. वर्ग विचलनों का योग: सभी वर्ग विचलनों का योग करें।
5. विचरण की गणना करें: कुल योग को डेटा बिंदुओं की संख्या में से एक घटाकर (N-1) विभाजित करें।
सूत्र:
[ s^2 = \frac{\sum (x_i – \bar{x})^2}{N-1} \]
उदाहरण:
नमूना डेटा सेट [3, 7, 7, 19] पर विचार करें।
नमूना माध्य (x̄) = (3+7+7+19) / 4 = 9
– विचलन: [3-9, 7-9, 7-9, 19-9] = [-6, -2, -2, 10]
– वर्ग विचलन: [36, 4, 4, 100]
– वर्ग विचलनों का योग: 36+4+4+100 = 144
– विचरण (s²) = 144 / (4-1) = 144 / 3 = 48
विचरण की व्याख्या
उच्च विचरण यह दर्शाता है कि डेटा बिंदु माध्य से अधिक फैले हुए हैं, जबकि निम्न विचरण का अर्थ है कि वे माध्य के निकट हैं। हालांकि, विचरण को सीधे समझना हमेशा आसान नहीं होता क्योंकि यह वर्ग इकाई में होता है। डेटा की मूल इकाई में वापस लाने के लिए, हम अक्सर विचरण का वर्गमूल लेते हैं, जिससे हमें मानक विचलन (σ² या s) प्राप्त होता है।
मानक विचलन:
[ σ = √σ²]
[ s = √s^2} ]
ऊपर दिए गए जनसंख्या उदाहरण में, मानक विचलन होगा:
[σ = √4 = 2]
आम गलतियाँ से बचने के लिए
1. जनसंख्या और नमूना सूत्रों को भ्रमित करना: याद रखें कि जनसंख्या विचरण \( N \) का उपयोग करता है जबकि नमूना विचरण \( N-1 \) का उपयोग करता है।
2. वर्ग करने की प्रक्रिया को अनदेखा करना: ऋणात्मक मानों से छुटकारा पाने के लिए विचलनों का वर्ग करना महत्वपूर्ण है।
3. माध्य लगाना भूल जाना: विचलन की गणना हमेशा माध्य से की जाती है।
उपकरण और सॉफ्टवेयर
हालांकि अवधारणा को समझने के लिए हाथ से विचरण की गणना करना उत्कृष्ट है, व्यवहार में, आप माइक्रोसॉफ्ट एक्सेल, पायथन, आर, या विशेष सांख्यिकीय उपकरणों जैसे सॉफ़्टवेयर का उपयोग कर सकते हैं जो विचरण की गणना शीघ्रता से कर सकते हैं:
– एक्सेल: जनसंख्या विचरण के लिए `VAR.P()` और नमूना विचरण के लिए `VAR.S()` का उपयोग करें।
– पायथन: जनसंख्या विचरण के लिए `numpy.var()` का उपयोग करें और नमूना विचरण के लिए पैरामीटर `ddof=1` सेट करें।
– R : नमूना विचरण के लिए `var()` का उपयोग करें। जनसंख्या विचरण के लिए, परिणाम को `(N-1)/N` से गुणा करें।
निष्कर्ष
डेटा विश्लेषण में शामिल किसी भी व्यक्ति के लिए विचरण को समझना और उसकी गणना करना मूलभूत है। यह आपको डेटा के फैलाव की जानकारी देता है और अधिक जटिल सांख्यिकीय विश्लेषणों के लिए एक आधारशिला है। बताए गए चरणों का पालन करके और सामान्य गलतियों से बचकर, आप विचरण की सटीक गणना और व्याख्या कर सकते हैं, जिससे ठोस सांख्यिकीय अंतर्दृष्टि प्राप्त होती है।