सहसम्बन्ध गुणांक निर्धारण: परिचय, विधिहरू, र प्रयोगहरू
सहसम्बन्ध गुणांक भनेको डेटासेटमा दुई चरहरू बीचको सम्बन्धको बल निर्धारण गर्ने तथ्याङ्कीय मापन हो। सहसम्बन्धहरू -१ देखि १ सम्मका हुन्छन्। १ वा -१ को नजिकको गुणांक मानले दुई चरहरू बीचको बलियो सम्बन्धलाई जनाउँछ। ० को नजिकको गुणांक मानले दुई चरहरू बीच कुनै बलियो सम्बन्ध नभएको जनाउँछ। यस लेखले सहसम्बन्ध गुणांक, यसको गणना गर्ने विधिहरू, यसको व्याख्या, र विभिन्न क्षेत्रहरूमा यसको प्रयोगहरूको बारेमा छलफल गर्नेछ।
सहसम्बन्ध गुणांकको परिचय
सहसम्बन्ध गुणांकले हामीलाई दुई चरहरू कति नजिकबाट सम्बन्धित छन् भन्ने संख्यात्मक दृष्टिकोण दिन्छ। सम्बन्धको दिशाको आधारमा सहसम्बन्ध गुणांकहरूलाई दुई मुख्य प्रकारमा विभाजन गरिएको छ:
१. सकारात्मक सहसम्बन्ध गुणांक: जब एउटा चर बढ्छ, अर्को चर पनि बढ्छ भन्ने बुझाउँछ।
२. ऋणात्मक सहसम्बन्ध गुणांक: जब एउटा चर बढ्छ, अर्को चर घट्छ भन्ने बुझाउँछ।
दुई चरहरू बीचको सम्बन्धलाई सम्बन्धको बलको आधारमा तीन प्रकारमा विभाजन गर्न सकिन्छ:
१. बलियो सहसम्बन्ध: गुणांक -१ वा १ को नजिक छ।
२. मध्यम सहसम्बन्ध: गुणांक -०.५ देखि -१ वा ०.५ देखि १ को बीचमा हुन्छ।
३. कमजोर सहसम्बन्ध: गुणांक ० को नजिक छ।
सहसम्बन्ध गुणांक गणना गर्ने विधि
सहसम्बन्ध गुणांक गणना गर्न धेरै सामान्य विधिहरू प्रयोग गरिन्छ, जसमा पियर्सनको सहसम्बन्ध, स्पियरम्यानको सहसम्बन्ध, र केन्डलको सहसम्बन्ध समावेश छन्। यी प्रत्येक विधिहरूबारे थप विस्तृत रूपमा छलफल गरौं।
१. पियर्सन सहसम्बन्ध
पियर्सन सहसम्बन्ध गुणांक प्रायः तब प्रयोग गरिन्छ जब दुबै चरहरू निरन्तर हुन्छन् र सामान्य वितरण हुन्छ। पियर्सन सहसम्बन्ध गुणांकको लागि सूत्र यो हो:
\[ r = \frac {n(\सिग्मा xy) – (\सिग्मा x)(\सिग्मा y)}{ \sqrt{ [n \सिग्मा x^2 – (\सिग्मा x)^2] [n \सिग्मा y^2 – (\सिग्मा y)^2 ] } } \]
कहाँ:
– \( r \) = सहसम्बन्ध गुणांक,
– \( n \) = डेटा जोडीहरूको संख्या,
– \( \Sigma xy \) = डेटा जोडीहरूको गुणनफलको योगफल \( x \) र \( y \),
– \( \सिग्मा x \) = मानहरूको योगफल \( x \),
– \( \सिग्मा y \) = मानहरूको योगफल \( y \),
– \( \सिग्मा x^2 \) = \( x \) को वर्गहरूको योगफल,
– \( \Sigma y^2 \) = \( y \) को वर्गहरूको योगफल।
२. स्पियरम्यानको श्रेणी सहसम्बन्ध
स्पियरम्यान सहसम्बन्ध गुणांक क्रमिक डेटाको लागि वा सामान्यताको धारणा पूरा गर्न नसकिने अवस्थामा प्रयोग गरिन्छ। स्पियरम्यान सहसम्बन्ध तिनीहरूको वास्तविक मानहरूको सट्टा डेटा मानहरूको श्रेणीकरणमा आधारित हुन्छ। स्पियरम्यान सहसम्बन्ध गुणांकको लागि सूत्र यो हो:
\[ \rho = १ – \frac {६\सिग्मा d_i^२}{n(n^२-१)} \]
कहाँ:
– \( \rho \) = स्पियरम्यानको सहसम्बन्ध गुणांक,
– \( d_i \) = डेटा जोडीहरूको श्रेणीकरण बीचको भिन्नता \( x \) र \( y \),
– \( n \) = डेटा जोडीहरूको संख्या।
३. केन्डलको ताउ सहसम्बन्ध
केन्डलको सहसम्बन्ध गुणांकले दुई क्रमिक चरहरू बीचको सम्बन्धको बल मापन गर्दछ। स्पियरम्यानको विपरीत, केन्डलको सहसम्बन्धले कन्कॉर्डेन्ट र डिस्कोर्डेन्ट जोडीहरूको संख्यामा बढी ध्यान केन्द्रित गर्दछ। केन्डलको सहसम्बन्ध गुणांकको सूत्र यस प्रकार छ:
\[ \tau = \frac{ (C – D)} { \sqrt{(C + D + T) (C + D + U) } } \]
कहाँ:
– \( \tau \) = केन्डलको सहसम्बन्ध गुणांक,
– \( C \) = कन्कॉर्डेन्ट जोडीहरूको संख्या,
– \( D \) = असंगत जोडीहरूको संख्या,
– \( T \) = चरमा श्रृंखला जोडीहरूको संख्या \( x \),
– \( U \) = चर \( y \) मा श्रृंखला जोडीहरूको संख्या।
सहसम्बन्ध गुणांकको व्याख्या
सहसम्बन्ध गुणांकको व्याख्या प्राप्त गुणांकको मानमा निर्भर गर्दछ:
– गुणांक +१: उत्तम सकारात्मक सम्बन्ध।
– गुणांक ०.७ देखि ०.९: बलियो सकारात्मक सम्बन्ध।
– गुणांक ०.४ देखि ०.६: मध्यम सकारात्मक सम्बन्ध।
– गुणांक ०.१ देखि ०.३: कमजोर सकारात्मक सम्बन्ध।
– गुणांक ०: कुनै सम्बन्ध छैन।
– गुणांक -०.१ देखि -०.३: कमजोर नकारात्मक सम्बन्ध।
– गुणांक -०.४ देखि -०.६: मध्यम नकारात्मक सम्बन्ध।
– गुणांक -०.७ देखि -०.९: बलियो नकारात्मक सम्बन्ध।
– गुणांक -१: पूर्ण नकारात्मक सम्बन्ध।
सहसम्बन्ध गुणांक आवेदन
अर्थशास्त्र, सामाजिक विज्ञान, स्वास्थ्य, शिक्षा, र अन्य धेरै क्षेत्रहरूमा सहसम्बन्ध गुणांकको विस्तृत दायरा छ। यहाँ केही उदाहरणहरू छन्:
१. अर्थशास्त्र: मुद्रास्फीति र बेरोजगारी, वा उपभोक्ता खर्च र आम्दानी बीचको सम्बन्ध निर्धारण गर्ने।
२. सामाजिक विज्ञान: शिक्षा र आम्दानी, वा सामाजिक सञ्जाल र मनोवैज्ञानिक कल्याण बीचको सम्बन्ध निर्धारण गर्ने।
३. स्वास्थ्य: धुम्रपान गर्ने बानी र फोक्सोको क्यान्सरका केसहरू, वा सक्रिय जीवनशैली र मुटुको स्वास्थ्य बीचको सम्बन्धको तुलना गर्ने।
४. शिक्षा: अध्ययन समय र परीक्षाको नतिजा, वा कक्षाको आकार र विद्यार्थी उपलब्धि बीचको सम्बन्धको जाँच गर्ने।
डेटासेट प्रयोग गर्ने व्यावहारिक उदाहरणहरू
मानौं हामीसँग एउटा डेटासेट छ जसमा १० जना विद्यार्थीहरूको घण्टामा गणित परीक्षाको अङ्क र अध्ययन समय समावेश छ:
"'
विद्यार्थीहरूको अध्ययन घण्टा गणित ग्रेडहरू
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
९ ७ ९१
१० ५ ८७
"'
हामी Study_Hours र Math_Score बीचको Pearson सहसम्बन्ध गुणांक गणना गर्न सक्छौं। Pearson को सूत्र प्रयोग गरेर, हामी पहिले \( \Sigma x \), \( \Sigma y \), \( \Sigma xy \), \( \Sigma x^2 \), र \( \Sigma y^2 \) गणना गर्छौं, त्यसपछि \( r \) को मान प्राप्त गर्न यी मानहरूलाई सूत्रमा प्रतिस्थापन गर्छौं।
केसिम्पुलन
दुई चरहरू बीचको सम्बन्धको बल र दिशा निर्धारण गर्न डेटा विश्लेषणमा सहसम्बन्ध गुणांक एक शक्तिशाली उपकरण हो। प्रभावकारी डेटा विश्लेषणको लागि सहसम्बन्ध गुणांकको अवधारणा, गणना विधिहरू र व्याख्या बुझ्नु आवश्यक छ। उचित बुझाइको साथ, हामी विभिन्न क्षेत्रहरूमा चरहरू बीचको सहसम्बन्धहरू राम्रोसँग निर्धारण गर्न सक्छौं र थप सूचित, डेटा-संचालित निर्णयहरू गर्न सक्छौं।