စာရင်းအင်းများတွင် ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာခြင်း- နက်ရှိုင်းသော ချဉ်းကပ်မှု
ခွဲခြားစိတ်ဖြာခြင်းဆိုသည်မှာ ဒေတာများကို အမျိုးအစားအမျိုးမျိုးအဖြစ် အုပ်စုဖွဲ့ရာတွင် အလွန်အသုံးဝင်သော စာရင်းအင်းနည်းလမ်းတစ်ခုဖြစ်သည်။ ၎င်းသည် လူမှုရေးသိပ္ပံ၊ ဇီဝဆေးပညာ၊ ဘဏ္ဍာရေး၊ စျေးကွက်ရှာဖွေရေးနှင့် အခြားနယ်ပယ်များစွာ အပါအဝင် ဘာသာရပ်အမျိုးမျိုးတွင် မကြာခဏအသုံးပြုလေ့ရှိသော အစွမ်းထက်ကိရိယာတစ်ခုဖြစ်သည်။ ဤဆောင်းပါးတွင်၊ ခွဲခြားစိတ်ဖြာခြင်း၏ ပုံစံများ၊ အသုံးပြုပုံများ၊ နည်းလမ်းများနှင့် အသုံးချမှုများထဲသို့ ပိုမိုနက်ရှိုင်းစွာ လေ့လာသွားပါမည်။
ခွဲခြားစိတ်ဖြာခြင်းကို နားလည်ခြင်း
ရိုးရိုးလေးပြောရရင် discriminant analysis ဆိုတာ သိထားတဲ့ အမျိုးအစားတွေပါတဲ့ ရှိပြီးသားဒေတာအစုအဝေးအပေါ် အခြေခံပြီး အချက်အလက်အသစ်တွေရဲ့ အမျိုးအစားတွေ ဒါမှမဟုတ် အုပ်စုတွေကို ခန့်မှန်းဖို့အသုံးပြုတဲ့ စာရင်းအင်းနည်းလမ်းတစ်ခုပါ။ ပိုပြီးနည်းပညာအရဆိုရင် discriminant analysis ဆိုတာ ဒေတာကို အမျိုးအစားနှစ်ခု ဒါမှမဟုတ် နှစ်ခုထက်ပိုတဲ့ အမျိုးအစားတွေအဖြစ် ခွဲထုတ်ဖို့ ဒါမှမဟုတ် အုပ်စုဖွဲ့ဖို့အတွက် discriminant function တစ်ခုကို ဖန်တီးပေးတဲ့ နည်းပညာတစ်ခုပါ။
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု၏ လုပ်ဆောင်ချက်များနှင့် ရည်ရွယ်ချက်များ
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု၏ အဓိကရည်မှန်းချက်မှာ ရှိပြီးသား အမျိုးအစားအုပ်စုများအကြား ကွာခြားချက်များကို အမြင့်ဆုံးဖြစ်အောင် လုပ်ဆောင်ရန်ဖြစ်သည်။ ခွဲခြားဆက်ဆံမှု လုပ်ဆောင်ချက်သည် အမျိုးအစားအမျိုးမျိုးကို ခွဲခြားရာတွင် အထိရောက်ဆုံးသော ကိန်းရှင်များ၏ မျဉ်းဖြောင့်ပေါင်းစပ်မှုကို ရှာဖွေရန် ရည်ရွယ်သည်။ ဤလုပ်ဆောင်ချက်ကို ရှာဖွေခြင်းဖြင့်၊ ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှုသည် အရေးကြီးသော လုပ်ဆောင်ချက်နှစ်ခုကို လုပ်ဆောင်နိုင်သည်-
၁။ အမျိုးအစားခွဲခြားခြင်း- လွတ်လပ်သောကိန်းရှင်၏တန်ဖိုးအပေါ် အခြေခံ၍ လူပုဂ္ဂိုလ်များ သို့မဟုတ် အရာဝတ္ထုများကို ကြိုတင်သတ်မှတ်ထားသော အမျိုးအစားများအဖြစ် အမျိုးအစားခွဲခြားခြင်း။
၂။ ခွဲခြားသတ်မှတ်ခြင်း- မတူညီသော အမျိုးအစားများကို ခွဲခြားရာတွင် မည်သည့်ပြောင်းလဲနေသော ကိန်းရှင်များသည် သြဇာအရှိဆုံးဖြစ်သည်ကို ဆုံးဖြတ်ပါ။
ခွဲခြားသတ်မှတ်ခြင်း ခွဲခြမ်းစိတ်ဖြာမှု အမျိုးအစားများ
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု အမျိုးအစားများစွာရှိပြီး၊ ၎င်းတို့သည် ပါဝင်သည့် အမျိုးအစားအရေအတွက်ပေါ်တွင် အများဆုံးမူတည်ပါသည်-
၁။ Linear Discriminant Analysis (LDA): အချက်အလက်၏ ပုံမှန်ဖြန့်ဖြူးမှုနှင့် အမျိုးအစားတစ်ခုစီ၏ covariance ညီမျှမှုဆိုင်ရာ ယူဆချက်များ ကိုက်ညီသည့်အခါ အသုံးပြုသည်။ LDA သည် အုပ်စုအကြားနှင့် အုပ်စုအတွင်း ကွဲပြားမှုအကြား အချိုးအစားကို အမြင့်ဆုံးဖြစ်စေသည့် ခန့်မှန်းကိန်းရှင်များ၏ linear ပေါင်းစပ်မှုကို ရှာဖွေရန် ကြိုးစားသည်။
၂။ Quadratic Discriminant Analysis (QDA): တူညီသော covariances ၏ယူဆချက်မကိုက်ညီသည့်အခါအသုံးပြုသည်။ QDA သည် LDA ထက်ပိုမိုပြောင်းလွယ်ပြင်လွယ်ရှိသည်၊ အဘယ်ကြောင့်ဆိုသော် ၎င်းသည် အမျိုးအစားတစ်ခုစီအတွက် မတူညီသော covariance matrices များကို ခွင့်ပြုသောကြောင့်ဖြစ်သည်။
၃။ Canonical Discriminant Analysis (CDA): ပေါင်းစပ်မှုနှင့် categorical dependent variable အကြား ဆက်စပ်မှုကို အမြင့်ဆုံးဖြစ်စေရန်အတွက် လွတ်လပ်သော variable များ၏ linear ပေါင်းစပ်မှုကို အသုံးပြုသည်။
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု လုပ်ငန်းစဉ်
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု လုပ်ငန်းစဉ်တွင် အရေးကြီးသော အဆင့်များစွာ ပါဝင်သည်။ ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှုတွင် ယေဘုယျအားဖြင့် လိုက်နာလေ့ရှိသော အခြေခံအဆင့်များမှာ အောက်ပါအတိုင်းဖြစ်သည်။
၁။ အချက်အလက်စုဆောင်းခြင်း- ပထမအဆင့်မှာ လွတ်လပ်သောကိန်းရှင်များ (predictors) နှင့် အမျိုးအစားအလိုက်ကိန်းရှင်များ (dependent variables) ပါ၀င်သည့် အချက်အလက်များကို စုဆောင်းရန်ဖြစ်သည်။
၂။ ယူဆချက်စမ်းသပ်မှု- အချက်အလက်များသည် multivariate normality နှင့် covariance matrices များ၏ တန်းတူညီမျှမှုကဲ့သို့သော discriminant analysis ၏ ယူဆချက်များနှင့် ကိုက်ညီမှုရှိမရှိ အကဲဖြတ်ပါ။
၃။ ခွဲခြားသတ်မှတ်ခြင်းလုပ်ဆောင်ချက် ခန့်မှန်းခြင်း- ခွဲခြားသတ်မှတ်ခြင်းလုပ်ဆောင်ချက်ကို ခန့်မှန်းရန် သိရှိထားသော အမျိုးအစားများပါရှိသော အချက်အလက်များကို အသုံးပြုခြင်း။ ဤလုပ်ဆောင်ချက်သည် လွတ်လပ်သောကိန်းရှင်များ၏ မျဉ်းဖြောင့်ပေါင်းစပ်မှုတစ်ခုဖြစ်သည်။
၄။ လုပ်ဆောင်ချက်စမ်းသပ်ခြင်း- ဒေတာအုပ်စုဖွဲ့ရာတွင် discriminant function ၏ ထိရောက်မှုကို စမ်းသပ်ခြင်း။ ၎င်းကို ပုံမှန်အားဖြင့် အတည်ပြုချက်ဒေတာ သို့မဟုတ် cross-validation နည်းလမ်းများမှတစ်ဆင့် ပြုလုပ်လေ့ရှိသည်။
၅။ အချက်အလက်အသစ် အမျိုးအစားခွဲခြားခြင်း- သင့်လျော်သော အမျိုးအစားများအဖြစ် အချက်အလက်အသစ်များကို အမျိုးအစားခွဲခြားရန် ခွဲခြားသတ်မှတ်နိုင်သော လုပ်ဆောင်ချက်များကို အသုံးပြုခြင်း။
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှုကို အကောင်အထည်ဖော်ခြင်း
ခွဲခြားစိတ်ဖြာမှု အကောင်အထည်ဖော်မှုကို သရုပ်ပြရန်အတွက်၊ လက်တွေ့ဘဝ စျေးကွက်ရှာဖွေရေး ဥပမာတစ်ခုကို ယူကြည့်ကြပါစို့။ စျေးကွက်ရှာဖွေရေးသမားတစ်ဦးသည် ဖောက်သည်များကို ထုတ်ကုန်အသစ်တစ်ခုအပေါ် ၎င်းတို့၏ သဘောထားများအပေါ် အခြေခံ၍ အပိုင်းများအဖြစ် အမျိုးအစားခွဲခြားလိုသည်။ ရရှိနိုင်သော ဒေတာများတွင် အသက်၊ ဝင်ငွေ၊ ထုတ်ကုန် နှစ်သက်မှုများနှင့် ဝယ်ယူမှုကြိမ်နှုန်းတို့ ပါဝင်နိုင်သည်။
၁။ အချက်အလက်စုဆောင်းခြင်း- ဖောက်သည်၏ လူဦးရေဆိုင်ရာနှင့် အပြုအမူဆိုင်ရာ အချက်အလက်များပါရှိသော စစ်တမ်းများ သို့မဟုတ် အခြားရင်းမြစ်များမှ အချက်အလက်များကို လက်ခံရယူခြင်း။
၂။ ယူဆချက်စမ်းသပ်မှု- ဒေတာသည် ပုံမှန်ဖြန့်ဖြူးမှုကို လိုက်နာခြင်းရှိမရှိနှင့် covariance matrix သည် ဖောက်သည်အပိုင်းတစ်ခုစီအတွက် ဆင်တူခြင်းရှိမရှိ စစ်ဆေးပါ။
၃။ ခွဲခြားသတ်မှတ်ခြင်းလုပ်ဆောင်ချက် ခန့်မှန်းခြင်း- SPSS၊ SAS သို့မဟုတ် R ကဲ့သို့သော စာရင်းအင်းဆော့ဖ်ဝဲကို အသုံးပြု၍ အပိုင်းများကို သိရှိထားသောဒေတာအပေါ် အခြေခံ၍ ခွဲခြားသတ်မှတ်ခြင်းလုပ်ဆောင်ချက်ကို တွက်ချက်သည်။
၄။ လုပ်ဆောင်ချက်စမ်းသပ်ခြင်း- cross-validation ကဲ့သို့သော နည်းလမ်းများမှတစ်ဆင့် ခွဲခြားဆက်ဆံသည့် လုပ်ဆောင်ချက်များ၏ တရားဝင်မှုစမ်းသပ်မှုများ ရယူခြင်း။
၅။ ဒေတာအမျိုးအစားခွဲခြားမှုအသစ်- နောက်ထပ်စျေးကွက်ရှာဖွေရေးလှုပ်ရှားမှုများအတွက် ဖောက်သည်အပိုင်းအစများကို ဆုံးဖြတ်ရန် ဒေတာအသစ်များတွင် ခွဲခြားသတ်မှတ်နိုင်သော လုပ်ဆောင်ချက်များကို အသုံးပြုခြင်း။
ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာခြင်း၏ အကျိုးကျေးဇူးများနှင့် ကန့်သတ်ချက်များ
Manfaat-
၁။ အုပ်စုဖွဲ့ခြင်းတွင် ထိရောက်မှု- ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှုသည် variable များ၏ linear ပေါင်းစပ်မှုများအပေါ် အခြေခံ၍ မတူညီသော အမျိုးအစားများအဖြစ် data များကို အုပ်စုဖွဲ့ရာတွင် အလွန်ထိရောက်မှုရှိပါသည်။
၂။ ရိုးရှင်းစေခြင်း- အမျိုးအစားများကို ခွဲခြားသည့် အဓိကအစိတ်အပိုင်းများကို ရှာဖွေခြင်းဖြင့် ခွဲခြားစိတ်ဖြာမှုသည် ရှုပ်ထွေးသောပြဿနာများကို ရိုးရှင်းစေသည်။
၃။ ကျယ်ပြန့်သော အသုံးချမှု- စျေးကွက်ရှာဖွေရေး၊ ဇီဝဆေးပညာ၊ စိတ်ပညာနှင့် ငွေကြေးစီမံခန့်ခွဲမှုကဲ့သို့သော နယ်ပယ်အမျိုးမျိုးတွင် အသုံးပြုသည်။
ကီတာဘာတာဆန်:
၁။ တင်းကျပ်သောယူဆချက်များ- covariance matrices များ၏ ပုံမှန်ဖြန့်ဖြူးမှုနှင့် ညီမျှမှုဆိုင်ရာယူဆချက်များကို လက်တွေ့တွင် မကြာခဏ မဖြည့်ဆည်းနိုင်ပါ။
၂။ ထိခိုက်လွယ်မှု- variable များတွင် သေးငယ်သော ပြောင်းလဲမှုများသည် ရလဒ်များအပေါ် ကြီးမားသော သက်ရောက်မှုရှိနိုင်သောကြောင့် ဂရုတစိုက် ဒေတာသန့်ရှင်းရေးနှင့် ကြိုတင်လုပ်ဆောင်ခြင်း လိုအပ်ပါသည်။
၃။ အလွန်အကျွံပြင်ဆင်ခြင်း- မော်ဒယ်ကို လေ့ကျင့်ရေးဒေတာနှင့် အလွန်အကျွံပြင်ဆင်ခြင်း၏အန္တရာယ်၊ ၎င်းသည် အချက်အလက်အသစ်များသို့ ယေဘုယျပြုလုပ်ခြင်းကို လျှော့ချနိုင်သည်။
ခွဲခြားစိတ်ဖြာခြင်းဆိုင်ရာ ဖြစ်ရပ်လေ့လာမှုများ
ဥပမာအနေနဲ့ ကျန်းမာရေးစောင့်ရှောက်မှုကဏ္ဍက ဖြစ်ရပ်လေ့လာမှုတစ်ခုကို ကြည့်ကြရအောင်။ အသက်၊ သွေးပေါင်ချိန်၊ သွေးတွင်းသကြားဓာတ်ပမာဏနဲ့ ဆေးမှတ်တမ်းစတဲ့ ကွဲပြားတဲ့ အချက်အလက်တွေပါဝင်တဲ့ ဆေးရုံလူနာဒေတာတွေ ရှိတယ်လို့ ယူဆပါ။ ရည်မှန်းချက်ကတော့ လူနာတွေကို နှလုံးရောဂါဖြစ်နိုင်ခြေ မြင့်မားတဲ့၊ အလယ်အလတ် ဒါမှမဟုတ် နည်းတဲ့ အမျိုးအစားခွဲခြားဖို့ပါ။
၁။ အချက်အလက်စုဆောင်းခြင်း- အချက်အလက်များကို လူနာ၏ ဆေးမှတ်တမ်းများမှ ရယူသည်။
၂။ ယူဆချက်စမ်းသပ်မှု- ဒေတာအုပ်စုများ၏ multivariate normality နှင့် covariance equality ကို အကဲဖြတ်ခြင်း။
၃။ ခွဲခြားဆက်ဆံမှုလုပ်ဆောင်ချက်ခန့်မှန်းခြင်း- နှလုံးရောဂါဖြစ်နိုင်ခြေအုပ်စုများကို အကောင်းဆုံးခွဲခြားပေးသည့် ကိန်းရှင်များ၏ မျဉ်းဖြောင့်ပေါင်းစပ်မှုကို ဆုံးဖြတ်ရန် ခွဲခြားဆက်ဆံမှုခွဲခြမ်းစိတ်ဖြာမှုကို အသုံးပြုခြင်း။
၄။ လုပ်ဆောင်ချက်စမ်းသပ်ခြင်း- အတည်ပြုချက်ဒေတာဖြင့် ခွဲခြားသတ်မှတ်သည့် လုပ်ဆောင်ချက်ကို အကဲဖြတ်ပါ။
၅။ အချက်အလက်အမျိုးအစားခွဲခြားမှုအသစ်- အန္တရာယ်အကဲဖြတ်ရန်အတွက် လူနာအချက်အလက်အသစ်များအတွက် ခွဲခြားသတ်မှတ်သည့်လုပ်ဆောင်ချက်များကို အသုံးချခြင်း။
ကိစ္စအများစုတွင် ခွဲခြားဆက်ဆံမှု ခွဲခြမ်းစိတ်ဖြာမှု၏ ရလဒ်များသည် ဆေးဘက်ဆိုင်ရာပညာရှင်များအား လူနာ၏ အခြေအနေကို ကနဦး အကဲဖြတ်ရာတွင် အထောက်အကူပြုပြီး၊ ထို့နောက် ပိုမိုနက်ရှိုင်းပြီး တိကျသော ရောဂါရှာဖွေရေး လုပ်ထုံးလုပ်နည်းများဖြင့် ဆက်လက်လုပ်ဆောင်နိုင်သည်။
နိဂုံး
ခွဲခြားစိတ်ဖြာခြင်းသည် အသုံးချမှုအမျိုးမျိုးတွင် အကျိုးကျေးဇူးများစွာကို ပေးဆောင်သည့် အစွမ်းထက်ပြီး ပြောင်းလွယ်ပြင်လွယ်ရှိသော စာရင်းအင်းကိရိယာတစ်ခုဖြစ်သည်။ ဤချဉ်းကပ်မှုကို အသုံးပြုခြင်းဖြင့်၊ ကျွန်ုပ်တို့သည် အချက်အလက်များကို မတူညီသောအမျိုးအစားများအဖြစ် ထိရောက်စွာအုပ်စုဖွဲ့နိုင်သည်၊ အစုအဖွဲ့ဖွဲ့စည်းခြင်းကို လွှမ်းမိုးသောအချက်များကို နားလည်နိုင်ပြီး ဆုံးဖြတ်ချက်ချခြင်းကို အထောက်အကူပြုနိုင်သည်။ သို့သော်၊ တိကျပြီး ယုံကြည်စိတ်ချရသော ရလဒ်များကို သေချာစေရန် ပါဝင်ပတ်သက်သော ယူဆချက်များနှင့် ကန့်သတ်ချက်များကို ထည့်သွင်းစဉ်းစားရန် အရေးကြီးပါသည်။ ပိုမိုရှုပ်ထွေးပြီး ကြီးမားသော ဒေတာအစုံများ ကမ္ဘာတွင်၊ ခွဲခြားစိတ်ဖြာခြင်းသည် အသုံးဝင်ဆုံးနှင့် ဆန်းသစ်တီထွင်မှုအရှိဆုံး အစုအဖွဲ့ဖွဲ့စည်းခြင်းနည်းလမ်းများထဲမှ တစ်ခုအဖြစ် ရှိနေဆဲဖြစ်သည်။