सहसंबंध गुणांक का निर्धारण

सहसंबंध गुणांक का निर्धारण: परिचय, विधियाँ और अनुप्रयोग

सहसंबंध गुणांक एक सांख्यिकीय माप है जो डेटासेट में दो चरों के बीच संबंध की मजबूती को निर्धारित करता है। सहसंबंध का मान -1 से 1 तक होता है। 1 या -1 के निकट गुणांक मान दो चरों के बीच मजबूत संबंध दर्शाता है। 0 के निकट गुणांक मान दो चरों के बीच कोई मजबूत संबंध नहीं दर्शाता है। इस लेख में सहसंबंध गुणांक, इसकी गणना की विधियाँ, इसकी व्याख्या और विभिन्न क्षेत्रों में इसके अनुप्रयोगों पर चर्चा की जाएगी।

सहसंबंध गुणांक का परिचय

सहसंबंध गुणांक हमें यह संख्यात्मक रूप से दर्शाता है कि दो चर आपस में कितने घनिष्ठ रूप से संबंधित हैं। सहसंबंध गुणांक को संबंध की दिशा के आधार पर दो मुख्य प्रकारों में विभाजित किया गया है:

1. सकारात्मक सहसंबंध गुणांक: यह दर्शाता है कि जब एक चर बढ़ता है, तो दूसरा चर भी बढ़ता है।
2. ऋणात्मक सहसंबंध गुणांक: यह दर्शाता है कि जब एक चर बढ़ता है, तो दूसरा चर घटता है।

दो चरों के बीच के संबंध को भी संबंध की मजबूती के आधार पर तीन प्रकारों में विभाजित किया जा सकता है:

1. प्रबल सहसंबंध: गुणांक -1 या 1 के करीब है।
2. मध्यम सहसंबंध: गुणांक -0.5 से -1 या 0.5 से 1 के बीच होता है।
3. कमजोर सहसंबंध: गुणांक 0 के करीब है।

सहसंबंध गुणांक की गणना करने की विधि

सहसंबंध गुणांक की गणना के लिए कई सामान्य विधियाँ उपयोग की जाती हैं, जिनमें पियर्सन सहसंबंध, स्पीयरमैन सहसंबंध और केंडल सहसंबंध शामिल हैं। आइए इनमें से प्रत्येक विधि पर विस्तार से चर्चा करें।

1. पियर्सन सहसंबंध
पियर्सन सहसंबंध गुणांक का उपयोग अक्सर तब किया जाता है जब दोनों चर सतत हों और उनका सामान्य वितरण हो। पियर्सन सहसंबंध गुणांक का सूत्र इस प्रकार है:

[ r = \frac {n(\Sigma xy) – (\Sigma x)(\Sigma y)}{ \sqrt{ [n \Sigma x^2 – (\Sigma x)^2] [n \Sigma y^2 – (\Sigma y)^2 ] } } \]

कहाँ:
– \( r \) = सहसंबंध गुणांक,
– \( n \) = डेटा युग्मों की संख्या,
– \( \Sigma xy \) = डेटा युग्मों \( x \) और \( y \) के गुणनफलों का योग
– \( \Sigma x \) = मानों का योग ​​\( x \),
– \( \Sigma y \) = मानों का योग ​​\( y \),
– \( \Sigma x^2 \) = \( x \) के वर्गों का योग
– \( \Sigma y^2 \) = \( y \) के वर्गों का योग।

2. स्पीयरमैन का रैंक सहसंबंध
स्पीयरमैन सहसंबंध गुणांक का उपयोग क्रमसूचक डेटा के लिए या तब किया जाता है जब सामान्यता की धारणा पूरी नहीं हो पाती है। स्पीयरमैन सहसंबंध डेटा मानों के वास्तविक मानों के बजाय उनकी रैंकिंग पर आधारित होता है। स्पीयरमैन सहसंबंध गुणांक का सूत्र इस प्रकार है:

[ ρ = 1 – √6πd_i^2}{n(n^2-1)} ]

कहाँ:
– \( \rho \) = स्पीयरमैन का सहसंबंध गुणांक,
– \( d_i \) = डेटा युग्मों \( x \) और \( y \) की रैंकिंग के बीच का अंतर,
– \( n \) = डेटा युग्मों की संख्या.

3. केंडल का ताऊ सहसंबंध
केंडल का सहसंबंध गुणांक दो क्रमसूचक चरों के बीच संबंध की मजबूती को मापता है। स्पीयरमैन के सहसंबंध गुणांक के विपरीत, केंडल का सहसंबंध गुणांक संगत और असंगत युग्मों की संख्या पर अधिक ध्यान केंद्रित करता है। केंडल के सहसंबंध गुणांक का सूत्र इस प्रकार है:

\[ \tau = \frac{ (C – D)} { \sqrt{(C + D + T) (C + D + U) } } \]

कहाँ:
– \( \tau \) = केंडल का सहसंबंध गुणांक,
– \( C \) = संगत युग्मों की संख्या,
– \( D \) = असंगत युग्मों की संख्या,
– \( T \) = चर \( x \) में श्रृंखला युग्मों की संख्या
– \( U \) = चर \( y \) में श्रृंखला युग्मों की संख्या।

सहसंबंध गुणांक की व्याख्या

सहसंबंध गुणांक की व्याख्या प्राप्त गुणांक के मान पर निर्भर करती है:

– गुणांक +1: पूर्ण सकारात्मक संबंध।
– गुणांक 0.7 से 0.9: मजबूत सकारात्मक संबंध।
– गुणांक 0.4 से 0.6: मध्यम सकारात्मक संबंध।
– गुणांक 0.1 से 0.3: कमजोर सकारात्मक संबंध।
– गुणांक 0: कोई संबंध नहीं।
– गुणांक -0.1 से -0.3: कमजोर नकारात्मक संबंध।
गुणांक -0.4 से -0.6: मध्यम नकारात्मक संबंध।
गुणांक -0.7 से -0.9: मजबूत नकारात्मक संबंध।
गुणांक -1: पूर्ण नकारात्मक संबंध।

सहसंबंध गुणांक अनुप्रयोग

सहसंबंध गुणांक का उपयोग अर्थशास्त्र, सामाजिक विज्ञान, स्वास्थ्य, शिक्षा आदि विभिन्न क्षेत्रों में व्यापक रूप से होता है। यहाँ कुछ उदाहरण दिए गए हैं:

1. अर्थशास्त्र: मुद्रास्फीति और बेरोजगारी के बीच, या उपभोक्ता खर्च और आय के बीच संबंध का निर्धारण करना।
2. सामाजिक विज्ञान: शिक्षा और आय के बीच, या सोशल मीडिया और मनोवैज्ञानिक कल्याण के बीच संबंध का निर्धारण करना।
3. स्वास्थ्य: धूम्रपान की आदतों और फेफड़ों के कैंसर के मामलों के बीच संबंध की तुलना करना, या सक्रिय जीवनशैली और हृदय स्वास्थ्य के बीच संबंध की तुलना करना।
4. शिक्षा: अध्ययन के समय और परीक्षा परिणामों के बीच, या कक्षा के आकार और छात्र उपलब्धि के बीच संबंध का परीक्षण करना।

डेटासेट का उपयोग करके व्यावहारिक उदाहरण

मान लीजिए हमारे पास 10 छात्रों के गणित परीक्षा स्कोर और अध्ययन समय (घंटों में) का डेटासेट है, जो इस प्रकार है:
"`
छात्रों के अध्ययन के घंटे, गणित के ग्रेड
1 5 85
2 3 78
3 6 90
4 2 76
5 4 80
6 6 88
7 5 85
8 3 82
9 7 91
10 5 87
"`
हम Study_Hours और Math_Score के बीच पियर्सन सहसंबंध गुणांक की गणना कर सकते हैं। पियर्सन के सूत्र का उपयोग करके, हम पहले \( \Sigma x \), \( \Sigma y \), \( \Sigma xy \), \( \Sigma x^2 \), और \( \Sigma y^2 \) की गणना करते हैं, फिर इन मानों को सूत्र में प्रतिस्थापित करके \( r \) का मान प्राप्त करते हैं।

निष्कर्ष

सहसंबंध गुणांक दो चरों के बीच संबंध की मजबूती और दिशा निर्धारित करने के लिए डेटा विश्लेषण का एक शक्तिशाली उपकरण है। प्रभावी डेटा विश्लेषण के लिए सहसंबंध गुणांक की अवधारणा, गणना विधियों और व्याख्या को समझना आवश्यक है। सही समझ के साथ, हम विभिन्न क्षेत्रों में चरों के बीच सहसंबंधों को बेहतर ढंग से निर्धारित कर सकते हैं और अधिक जानकारीपूर्ण, डेटा-आधारित निर्णय ले सकते हैं।

एक टिप्पणी छोड़ें

यह साइट स्पैम को कम करने के लिए Akismet का उपयोग करती है। जानें कि आपके कमेंट डेटा को कैसे प्रोसेस किया जाता है।