एकल डेटा का विचरण और मानक विचलन
सांख्यिकी वह विज्ञान है जो आंकड़ों के संग्रह, विश्लेषण, व्याख्या, प्रस्तुतिकरण और संगठन का अध्ययन करता है। सांख्यिकी का एक महत्वपूर्ण पहलू यह है कि हम आंकड़ों में परिवर्तनशीलता को कैसे मापते और समझते हैं। परिवर्तनशीलता के दो महत्वपूर्ण मापक विचरण और मानक विचलन हैं। यह लेख एक ही डेटा सेट पर ध्यान केंद्रित करते हुए विचरण और मानक विचलन पर गहराई से चर्चा करेगा, परिभाषाओं, सूत्रों, गणना चरणों की व्याख्या करेगा और अवधारणाओं को स्पष्ट करने के लिए व्यावहारिक उदाहरण प्रदान करेगा।
विचरण और मानक विचलन की परिभाषा
वरियन
विचरण (Variance) यह मापता है कि डेटा माध्य से कितना फैला हुआ है। यह डेटा सेट में विविधता या भिन्नता का एक संक्षिप्त विवरण प्रदान करता है। गणितीय रूप से, विचरण प्रत्येक डेटा मद के उसके माध्य से विचलन के वर्गों का औसत होता है।
मानक विचलन
मानक विचलन, जिसे मानक विचलन भी कहा जाता है, विचरण का वर्गमूल होता है। यह मूल डेटा के समान इकाइयों में डेटा के वितरण के बारे में जानकारी प्रदान करता है, जिससे वास्तविक जीवन के संदर्भों में इसकी व्याख्या करना आसान हो जाता है।
सूत्र और गणनाएँ
वरियन
आकार n के एकल डेटा सेट के विचरण (σ^2) की गणना करने के लिए, हम निम्नलिखित सूत्र का उपयोग कर सकते हैं:
[ σ² = (xᵢ – x)² n) का योगफल है]
कहाँ:
– \( x_i \) ith डेटा मान है।
– \( \bar{x} \) डेटा का माध्य या औसत है।
– n समुच्चय में डेटा की संख्या है।
– (x_i – \bar{x})^2 प्रत्येक डेटा और उसके माध्य के बीच के अंतर का वर्ग है।
मानक विचलन
मानक विचलन (σ) प्रसरण का वर्गमूल होता है, इसलिए इसका सूत्र इस प्रकार है:
[ σ = √σ²]
गणना के चरण
चरण 1: आंकड़ों का औसत (माध्य) ज्ञात करें
पहला चरण डेटा सेट का औसत (मीन) निकालना है। औसत की गणना सभी डेटा मानों को जोड़कर और डेटा मानों की संख्या से भाग देकर की जाती है।
\[ \bar{x} = \frac{\sum_{i=1}^{n} x_i}{n} \]
चरण 2: प्रत्येक डेटा सेट का माध्य के सापेक्ष अंतर ज्ञात कीजिए।
औसत प्राप्त करने के बाद, अगला चरण प्रत्येक डेटा मान और औसत के बीच का अंतर (विचलन) की गणना करना है।
[ d_i = x_i – \bar{x} \]
चरण 3: प्रत्येक विचलन का वर्ग करें
इसके बाद, प्रत्येक विचलन का वर्ग करें।
[ d_i^2 = (x_i – \bar{x})^2 \]
चरण 4: सभी वर्ग विचलनों का योग करें
पिछले चरण से प्राप्त सभी वर्गित परिणामों को जोड़ें।
[ \sum d_i^2 = \sum_{i=1}^{n} (x_i – \bar{x})^2 \]
चरण 5: विचरण की गणना करें
विचलनों के वर्गों के योग को आंकड़ों की संख्या (n) से विभाजित करने पर विचरण प्राप्त होता है।
[ σ² = √ᵢᵢ²⁻ᵢ ...
चरण 6: मानक विचलन की गणना करें
अंत में, विचरण का वर्गमूल लेकर मानक विचलन की गणना करें।
[ σ = √σ²]
Contoh Perhitungan
विचरण और मानक विचलन की गणना की अवधारणा को स्पष्ट करने के लिए, आइए निम्नलिखित उदाहरण देखें। मान लीजिए हमारे पास निम्नलिखित एकल डेटा सेट है: 4, 8, 6, 5, 3।
चरण 1: आंकड़ों का औसत ज्ञात करें
\[ \bar{x} = \frac{4 + 8 + 6 + 5 + 3}{5} = \frac{26}{5} = 5.2 \]
चरण 2: प्रत्येक डेटा सेट का माध्य के सापेक्ष अंतर ज्ञात कीजिए।
प्रत्येक डेटा मान और माध्य के बीच का अंतर:
– (4 – 5.2) = -1.2
– (8 – 5.2) = 2.8
– (6 – 5.2) = 0.8
– (5 – 5.2) = -0.2
– (3 – 5.2) = -2.2
चरण 3: प्रत्येक विचलन का वर्ग करें
प्रत्येक विचलन का वर्ग:
– (-1.2)^2 = 1.44
– 2.8^2 = 7.84
– 0.8^2 = 0.64
– (-0.2)^2 = 0.04
– (-2.2)^2 = 4.84
चरण 4: सभी वर्ग विचलनों का योग करें
[ \sum d_i^2 = 1.44 + 7.84 + 0.64 + 0.04 + 4.84 = 14.8 \]
चरण 5: विचरण की गणना करें
[σ² = 14.8/5 = 2.96]
चरण 6: मानक विचलन की गणना करें
\[ \sigma = \sqrt{2.96} \approx 1.72 \]
तो, इस उदाहरण में, डेटा का विचरण 2.96 है, और मानक विचलन लगभग 1.72 है।
व्याख्या
विचरण और मानक विचलन डेटा के फैलाव के बारे में महत्वपूर्ण जानकारी प्रदान करते हैं। ऊपर दिए गए उदाहरण में, 2.96 का विचरण यह दर्शाता है कि डेटा मानों का माध्य से औसत वर्ग विचलन 2.96 है। 1.72 का मानक विचलन यह दर्शाता है कि औसतन, डेटा मान माध्य से 1.72 इकाई विचलित होते हैं।
मानक विचलन को समझना आसान होता है क्योंकि इसकी इकाइयाँ मूल डेटा की इकाइयों के समान होती हैं। उदाहरण के लिए, आय सांख्यिकी के संदर्भ में, यदि डेटा का मानक विचलन $500 है, तो इसका अर्थ है कि औसत आय माध्य आय से $500 विचलित होती है।
दैनिक जीवन में अनुप्रयोग
विचरण और मानक विचलन की समझ को विभिन्न क्षेत्रों में लागू किया जा सकता है। वित्त में, मानक विचलन का उपयोग निवेश जोखिम को मापने के लिए किया जा सकता है। शिक्षा में, इसका उपयोग छात्रों के बीच परीक्षा अंकों में भिन्नता का मूल्यांकन करने के लिए किया जा सकता है। विनिर्माण में, यह उत्पादन भिन्नता को मापकर गुणवत्ता नियंत्रण में सहायता कर सकता है।
निष्कर्ष
विचरण और मानक विचलन, डेटा सेट में भिन्नता को समझने के लिए दो महत्वपूर्ण सांख्यिकीय उपकरण हैं। विचरण की गणना करके, हम यह निर्धारित कर सकते हैं कि डेटा कितना फैला हुआ है। मानक विचलन, जो विचरण का वर्गमूल है, अधिक सहज व्याख्या प्रदान करता है और मूल डेटा के समान इकाइयों में मापा जाता है। इन दोनों मापों को समझकर और इनकी गणना करने में सक्षम होकर, हम डेटा का बेहतर विश्लेषण कर सकते हैं और अधिक सटीक निर्णय ले सकते हैं।