कॅनोनिकल सहसंबंध विश्लेषण
पेंडाहुलुआन
अनेक अभ्यासांमध्ये, संशोधकांना अनेकदा अशा परिस्थितींचा सामना करावा लागतो जिथे व्हेरिएबल्सचे दोन संच असतात आणि प्रत्येक संचामध्ये अनेक निर्देशकांचा समावेश असतो. उदाहरणार्थ, शिक्षण क्षेत्रात, आपल्याकडे शिकण्याच्या घटकांविषयी व्हेरिएबल्सचा एक संच (प्रेरणा, अभ्यासाचे तास, कौटुंबिक पाठिंबा, इंटरनेटची उपलब्धता) आणि शिकण्याच्या परिणामांविषयी व्हेरिएबल्सचा दुसरा संच (गणितातील गुण, भाषेतील गुण, विज्ञानातील गुण आणि ग्रेड पॉइंट सरासरी) असू शकतो. महत्त्वाचा प्रश्न केवळ "प्रेरणेचा गणितातील गुणांशी संबंध आहे का?" हा नसून, "शिकण्याच्या घटकांचा संच आणि शिकण्याच्या परिणामांचा संच यांच्यातील एकूण संबंध किती दृढ आहे?" हा आहे. अशा प्रश्नांची उत्तरे देण्यासाठी, कॅनॉनिकल कोरिलेशन ॲनालिसिस (CCA) ही सर्वात समर्पक बहुचर सांख्यिकीय पद्धतींपैकी एक आहे.
कॅनॉनिकल कोरिलेशन ॲनालिसिस (CCA) हे दोन संचांमधील चलांमधील संबंध एकाच वेळी मोजण्यासाठी आणि स्पष्ट करण्यासाठी विकसित केले गेले. दुसऱ्या शब्दांत सांगायचे झाल्यास, CCA हे साध्या सहसंबंधाची (दोन चलांमधील) संकल्पना, दोन संचांमधील चलांच्या दोन रेषीय संयोगांमधील सहसंबंधापर्यंत विस्तारित करते. या लेखात CCA च्या मूलभूत संकल्पना, उद्दिष्ट्ये, विश्लेषणाचे टप्पे, अर्थबोध, तसेच त्याचे फायदे आणि मर्यादा यांवर चर्चा केली आहे.
कॅनॉनिकल कोरिलेशनची मूलभूत संकल्पना
सामान्य सहसंबंध (उदा. पिअरसन सहसंबंध) हा X आणि Y या दोन चलांमधील रेषीय संबंधाची शक्ती मोजतो. CCA दोन नवीन चलांना रेषीय संयोगाच्या रूपात तयार करून या संकल्पनेचे सामान्यीकरण करते:
– X संचासाठी पहिला प्रमाणिक चल:
U = a₁X₁ + a₂X₂ + … + aₚXₚ
– संच Y साठी पहिला कॅनोनिकल व्हेरिएट:
V = b₁Y₁ + b₂Y₂ + … + b_qY_q
गुणांक a आणि b अशाप्रकारे निवडले जातात की U आणि V मधील सहसंबंध सर्वाधिक असेल. या सर्वाधिक सहसंबंधाला पहिला कॅनॉनिकल सहसंबंध म्हणतात. एकदा पहिली जोडी मिळाली की, CCA वापरून चलांच्या पुढील जोड्या (दुसरी, तिसरी, इत्यादी) तयार करता येतात, ज्या मागील जोडीला लंब (असहसंबंधित) असतात.
संभाव्य कॅनोनिकल व्हेरिएट जोड्यांची संख्या min(p, q) आहे, जी दोन संचांमधील व्हेरिएबल्सची सर्वात लहान संख्या आहे.
उद्देश आणि वापर
जेव्हा संशोधनाची उद्दिष्ट्ये खालीलप्रमाणे असतात तेव्हा CCA चा वापर केला जातो:
१. दोन संचांतील चलांमधील संबंधाची ताकद एकत्रितपणे मोजा.
२. संच X आणि संच Y मधील चलांचा सर्वात संबंधित संयोग ओळखा.
३. बहुचर संबंधांचे आयाम कमी करून त्यांचे अनेक चल जोड्यांमध्ये रूपांतर करा, ज्यांचा अर्थ लावणे सोपे असते.
४. डेटामधील नमुन्यांचे अन्वेषण: कोणते चल प्रामुख्याने दोन डोमेनमधील संबंध स्पष्ट करतात.
उदाहरण अनुप्रयोग संदर्भ:
– मानसशास्त्र: “व्यक्तिमत्व गुणधर्मांचा” संच आणि “मानसिक आरोग्य निर्देशकांचा” संच यांच्यातील संबंध.
– अर्थव्यवस्था: ‘स्थूल निर्देशांकां’चा संच आणि ‘श्रम बाजार निर्देशांकां’चा संच यांच्यातील संबंध.
– आरोग्य विज्ञान: ‘जीवन सवयी’ आणि ‘नैदानिक मापदंड’ यांच्यातील संबंध.
डेटा गृहितके आणि आवश्यकता
अनेक बहुचर पद्धतींप्रमाणे, CCA मध्येही अनेक गृहितके आहेत ज्यांचा विचार निकाल स्थिर आणि अर्थपूर्ण होण्यासाठी करणे आवश्यक आहे:
१. रेषीय संबंध: CCA संचांमधील रेषीय संबंध दर्शवते. जर संबंध अ-रेषीय असेल, तर कॅनोनिकल कोरिलेशन त्या संबंधाची तीव्रता कमी लेखू शकते.
२. बहुचर सामान्यता: आदर्शपणे, चल बहुचर सामान्य वितरणाचे अनुसरण करतात, विशेषतः सार्थकता चाचणीसाठी. तथापि, व्यवहारात, डेटा पूर्णपणे सामान्य नसतानाही CCA चा वापर अनेकदा अन्वेषणात्मकपणे केला जातो.
३. प्रत्येक संचामध्ये अत्यंत बहुसहसंबंध नाही: उच्च सहसंबंध असलेले चल गुणांक अंदाजांना अस्थिर करू शकतात.
४. पुरेसा नमुना आकार: एक सामान्य नियम असा आहे की प्रत्येक चलसाठी किमान १०-२० निरीक्षणे असावीत, तथापि संशोधनाच्या संदर्भानुसार अधिकची आवश्यकता असू शकते.
याव्यतिरिक्त, चल तुलनात्मक किंवा प्रमाणित प्रमाणावर (झेड-स्कोर) असणे आवश्यक आहे जेणेकरून गुणांकांची तुलना करणे सोपे होईल.
कॅनोनिकल सहसंबंध विश्लेषणाचे टप्पे
सर्वसाधारणपणे, अतिरिक्त अभ्यासक्रम शिक्षण (CCA) आयोजित करण्याच्या टप्प्यांमध्ये खालील गोष्टींचा समावेश होतो:
१. चलांचे दोन संच निश्चित करा
चलांची गटवारी केवळ प्रयत्न आणि त्रुटीच्या आधारावर न करता, सिद्धांत किंवा संकल्पनात्मक चौकटीच्या आधारावर केली आहे याची खात्री करा.
२. डेटा तपासणी
प्रत्येक संचामध्ये गहाळ डेटा (गहाळ मूल्ये), आउटलायर्स, सामान्यता चाचण्या आणि सहसंबंध (मल्टीकोलिनियरिटी शोधण्यासाठी) यांचा समावेश आहे.
३. कॅनॉनिकल व्हेरिएट्सचा अंदाज लावणे
U₁–V₁, U₂–V₂, इत्यादी चल जोड्या निर्माण करते.
४. कॅनोनिकल सहसंबंधाची गणना करणे
प्रत्येक k व्या जोडीसाठी U_k आणि V_k यांच्यातील सहसंबंध.
५. सार्थकता चाचणी
मिळालेला कॅनोनिकल सहसंबंध सांख्यिकीयदृष्ट्या शून्यापेक्षा वेगळा आहे की नाही हे तपासते. सामान्यतः वापरल्या जाणाऱ्या चाचण्यांमध्ये विल्क्स लॅम्डा, पिलाईज ट्रेस (अधिक वेळा मॅनओव्हामध्ये), हॉटेलिंग्ज ट्रेस आणि रॉयज लार्जेस्ट रूट यांचा समावेश होतो. सीसीए मध्ये, विल्क्स लॅम्डाला अनेकदा प्राधान्य दिले जाते.
६. निकालांचे विश्लेषण
यात सहसंबंधाचे प्रमाण, भार, भार आणि परिवर्तनीय योगदानांचे मूल्यांकन समाविष्ट आहे.
CCA आउटपुट कसे वाचावे आणि त्याचा अर्थ कसा लावावा
CCA आउटपुटमध्ये सामान्यतः अनेक महत्त्वाचे घटक समाविष्ट असतात:
१. कॅनोनिकल सहसंबंध
हे मूल्य एका विशिष्ट जोडीतील U आणि V या चलांमधील संबंधाची तीव्रता दर्शवते. उदाहरणार्थ, 0,80 चा पहिला कॅनोनिकल सहसंबंध पहिल्या मितीमध्ये X या चलांच्या संयोजनात आणि Y या चलांच्या संयोजनात एक मजबूत रेषीय संबंध असल्याचे दर्शवतो.
कॅनॉनिकल R², म्हणजेच कॅनॉनिकल सहसंबंधाचा वर्ग, देखील अनेकदा सांगितला जातो. जर r = 0,80 असेल, तर R² = 0,64, याचा अर्थ असा की, त्या मितीवर, मूळ चलांमधील नव्हे, तर व्हेरिएट्समधील संबंधांच्या अर्थाने, कॅनॉनिकल व्हेरिएट Y मधील सुमारे 64% तफावत कॅनॉनिकल व्हेरिएट X द्वारे स्पष्ट केली जाऊ शकते (आणि याउलट).
२. कॅनॉनिकल वेट्स (कॅनॉनिकल वेट्स / कोएफिशियंट्स)
वेट्स (Weights) म्हणजे a आणि b हे कोएफिशियंट्स (coefficients) आहेत, जे U आणि V हे व्हेरिएट्स (variates) तयार करतात. तथापि, वेट्स अनेकदा मल्टिकोलिनियरिटीसाठी (multicollinearity) संवेदनशील असतात, त्यामुळे सारभूत अर्थनिर्णय सहसा केवळ वेट्सवर अवलंबून नसतो.
३. कॅनॉनिकल लोडिंग (कॅनॉनिकल लोडिंग / संरचना गुणांक)
लोडिंग म्हणजे मूळ चल आणि त्याचे प्रमाणिक चल यांच्यातील सहसंबंध होय. उदाहरणार्थ, U₁ वरील X₂ चे 0,70 चे लोडिंग याचा अर्थ असा की, X₂ हे X संचाच्या बाजूने पहिल्या प्रमाणिक मितीमध्ये जोरदार योगदान देते. लोडिंग्स सामान्यतः वजनांपेक्षा अधिक स्थिर आणि अर्थ लावण्यासाठी सोपे असतात.
४. क्रॉस-लोडिंग्ज
क्रॉस-लोडिंग म्हणजे एका संचातील चलांचा दुसऱ्या संचातील प्रमाणभूत चलांशी असलेला सहसंबंध (उदा., X₁ चा V₁ शी असलेला सहसंबंध). यामुळे क्रॉस-सेट संबंधाच्या आयामांशी कोणते चल सर्वात जवळून संबंधित आहेत हे समजण्यास मदत होते.
५. रिडंडन्सी इंडेक्स
रिडंडन्सी इंडेक्स हे दर्शवतो की, एका संचातील मूळ व्हेरिएबल्सच्या फरकापैकी किती फरक दुसऱ्या संचातील कॅनॉनिकल व्हेरिएबल्सद्वारे स्पष्ट केला जाऊ शकतो. हे महत्त्वाचे आहे कारण उच्च कॅनॉनिकल कोरिलेशनचा अर्थ असा नाही की मूळ व्हेरिएबल्समध्ये उच्च स्पष्टीकरणात्मक शक्ती आहे. रिडंडन्सीचा उपयोग अनेकदा व्यावहारिक मूल्याचे मूल्यांकन करण्यासाठी केला जातो (केवळ सांख्यिकीय महत्त्वासाठी नाही).
साधे चित्र
समजा, एक अभ्यास खालील गोष्टींमधील संबंध तपासतो:
– संच X (कामाची परिस्थिती): X₁ = कामाचा भार, X₂ = पर्यवेक्षकाचे सहकार्य, X₃ = कामाच्या तासांमधील लवचिकता
– संच Y (कल्याण): Y₁ = ताण, Y₂ = कामातील समाधान, Y₃ = झोपेची गुणवत्ता
CCA मध्ये r = 0,75 हा एक महत्त्वपूर्ण पहिला कॅनोनिकल सहसंबंध आढळू शकतो. लोडिंग्ज दर्शवतात की कामाचा भार आणि पर्यवेक्षकाचा पाठिंबा हे सर्वात प्रबळपणे U₁ तयार करतात, तर ताण आणि नोकरीतील समाधान हे सर्वात प्रबळपणे V₁ तयार करतात. सारभूत अर्थ: कामाची परिस्थिती आणि कल्याण यांच्यातील संबंधाचा मुख्य आयाम म्हणजे “कामाचा दबाव विरुद्ध पाठिंबा” यांचे संयोजन आहे, जे “ताण आणि समाधान” यांच्याशी जवळून संबंधित आहे.
कॅनोनिकल सहसंबंध विश्लेषणाचे फायदे
१. सर्वसमावेशक: एकाच वेळी दोन संचांमधील संबंध दर्शवते.
२. वारंवार चाचणी करण्याचा धोका कमी करा: एकामागून एक अनेक सहसंबंध करण्याच्या तुलनेत, ज्यामुळे टाईप I त्रुटीची शक्यता वाढते.
३. सुप्त संरचना शोधण्यास मदत करते: एकचलात्मक विश्लेषणातून न दिसणारे संबंधांचे पैलू उघड करते.
मर्यादा आणि आव्हाने
१. अन्वयार्थ लावणे गुंतागुंतीचे असू शकते: अनेक घटक (वजन, भार, अतिरिक्तता) एकत्रितपणे पाहिले पाहिजेत.
२. बहुसहरेखीयता आणि लहान नमुना आकारांप्रति संवेदनशील: अस्थिर गुणांक निर्माण करू शकते.
३. स्वरूपतः रेषीय: जोपर्यंत एखादे रूपांतरण किंवा इतर पद्धत वापरली जात नाही, तोपर्यंत अ-रेखीय संबंध विचारात घेतले जात नाहीत.
४. सैद्धांतिक आधाराची आवश्यकता आहे: स्पष्ट वैचारिक चौकटीशिवाय, प्रमाणभूत परिमाणांचा अर्थ लावणे हे अनुमानित असण्याची शक्यता असते.
बंद होत आहे
कॅनॉनिकल कोरिलेशन ॲनालिसिस (CCA) ही दोन संचांमधील चलांमधील संबंध एकाच वेळी समजून घेण्यासाठी एक शक्तिशाली बहुचलीय पद्धत आहे. क्रॉस-सेट कोरिलेशन्स (cross-set correlations) वाढवणारे कॅनॉनिकल व्हेरिएबल्स (canonical variables) तयार करून, CCA संशोधकांना साध्या कोरिलेशन किंवा सिंगल रिग्रेशनपेक्षा संबंधांचे अधिक व्यापक नमुने पाहण्यास मदत करते. तथापि, त्याच्या वापरासाठी गृहीतके, डेटाची गुणवत्ता आणि योग्य अर्थ लावण्याच्या पद्धतींकडे लक्ष देणे आवश्यक आहे (विशेषतः लोडिंग्स, क्रॉस-लोडिंग्स आणि रिडंडन्सीवर भर देऊन). दोन मुख्य डोमेन्समधील अनेक निर्देशकांचा समावेश असलेल्या संशोधनात, जटिल संबंधांचे अन्वेषण करण्यासाठी आणि त्यांना अर्थपूर्ण परिमाणांमध्ये सारांशित करण्यासाठी CCA एक शक्तिशाली साधन ठरू शकते.