Meriv Çawa Daneyên Kategorîk Analîz Dike
Daneyên kategorîk yek ji cureyên daneyên herî gelemperî ne ku di anketên lêkolîn, karsazî, pazarvanî, tenduristî, perwerde û heta anketên razîbûna xerîdaran de têne dîtin. Berevajî daneyên hejmarî (mînak, temen, bilindahî, dahat), ku dikarin bi karanîna navînî an jî devîasyona standard werin hesibandin, daneyên kategorîk etîket an komên wekî "Nêr/Mê", "Razî/Nerazî", "A/B/C," an "Memnûn/Bêalî/Nerazî" dihewîne. Ji ber xwezaya xwe ya kategorîk, teknîkên analîtîk nêzîkatiyên taybetî hewce dikin. Ev gotar gavên pratîkî û rêbazên hevpar ji bo analîzkirina bi bandor a daneyên kategorîk nîqaş dike.
1. Têgihîştina Cureyên Daneyên Kategorîk
Berî analîzkirinê, pêşî fêm bikin ka çi celeb daneyên kategorîk li cem we hene. Bi gelemperî, du celeb hene:
1) Navdêrî
Kategorî rêz nînin. Mînak: zayend, rengê bijarte, marqeya hilberê, herêma rûniştinê.
2) Rêzkirî
Kategorî rêzek an astekê hene. Mînak: asta razîbûnê (nerazî – maqûl – razî), asta perwerdeyê (lîse – lîsans – master), pîvana Likert (bi tundî nerazî me – bi tundî razî me).
Ev cudahî girîng e ji ber ku ew bandorê li teknîkên analîzê yên guncaw dike. Daneyên rêzkirî dikarin bi berçavgirtina rêza wan werin analîzkirin, lê daneyên nominal nikarin.
2. Amadekirina Daneyan: Kod, Etîket, û Paqijiya Daneyan
Analîzek baş her tim bi daneyên rêkxistî dest pê dike. Gavên amadekariyê yên pêşniyarkirî:
- Standardkirina nivîsandina kategoriyan: bo nimûne, divê "Nêr" û "Kur" werin hevgirtin da ku ew wekî kategoriyên cuda neyên hesibandin.
- Nirxên wenda bi rê ve bibin: biryar bidin ka kategoriyek cuda wekî "Bersiv neda" jê bibin, lê zêde bikin, an biafirînin.
- Ger pêwîst be kodkirinê biafirînin: mînak, Qebûlkirin=4, Bêalî=3, Neqebûlkirin=2. Ji bo nirxên nominal, koda hejmarî tenê etîketek e, ne nirxek matematîkî ye.
- Kategoriyên ku pir kêm in kontrol bikin: kategoriyên ku pir kêm in dikarin mudaxeleyî analîzê bikin; carinan ew hewce ne ku werin hev kirin da ku encamên stabîltir werin bidestxistin.
3. Analîza Wesfî: Frekans û Rêje
Riya herî bingehîn û girîng ji bo daneyên kategorîk ev e ku meriv hesab bike:
– Frekans: hejmara bersivkaran/çavdêriyan di her kategoriyê de.
- Rêje an jî rêjeyek: frekans dabeşkirî li ser daneyên giştî.
Nimûneyek hêsan: ji 200 bersivkaran, 120 "Memnûn", 50 "Bêalî" û 30 jî "Nerazî" bûn. Rêjeya bersivkarên razî %60 e.
Analîza danasînî nihêrînek destpêkê ya belavbûna kategoriyan peyda dike. Pir caran, dîtinên girîng li vir eşkere dibin: kategoriyên serdest, cûdahiyên di pêkhateyê de di navbera koman de, an hebûna kategoriyên "ecêb" ji ber hejmara wan a piçûk an mezin.
4. Dîtbarîkirina Guncaw ji bo Daneyên Kategorîk
Dîtbarîkirin alîkariya xwendevanan dikin ku qaliban zû fam bikin. Nexşeyên hevpar:
- Nexşeya bar (diagrama bar): ji bo navdêr û rêzdaran herî guncaw e.
- Nexşeya barên rêzkirî (barên rêzkirî): ji bo berawirdkirina pêkhateya kategoriyê li seranserê gelek koman baş e, mînakî razîbûn li gorî şaxê.
- Nexşeya pî: dikare were bikar anîn, lê heke gelek kategori an cûdahiyên piçûk hebin kêmtir bibandor e.
- Nexşeya mozaîk: ji bo dîtina têkiliya di navbera du guherbarên kategorîk de kêrhatî ye.
- Nexşeya Pareto: nexşeyek bar bi rêzkirin ji frekansa herî bilind ber bi nizm ve, ku pir caran ji bo analîza pêşîniya pirsgirêkan tê bikar anîn.
Serişte: Ji bo daneyên rêzkirî, kategoriyan li gorî astê rêz bikin (mînak, ji "Bi tundî nerazî me" heta "Bi tundî razî me"), ne li gorî rêza alfabetîk.
5. Çêkirina Crosstabekê
Eger hûn dixwazin têkiliya di navbera du guherbarên kategorîk de bibînin, xaçerêyek bikar bînin. Mînakî, têkiliya di navbera "Zayend" û "Tercîha Berhemê" an "Herêm" û "Rewşa Kirînê" de.
Crosstabulation tabloyek çêdike ku nîşan dide ka çend çavdêrî di kombînasyonek taybetî ya kategoriyan de ne. Hûn dikarin lê zêde bikin:
- Rêje li gorî rêzê: li ser belavkirina kategoriyên stûnan di her rêzê de disekine.
- Rêje li gorî stûnê: balê dikişîne ser belavkirina kategoriyên rêzan di her stûnê de.
- Rêjeya tevahî: beşdariya her şaneyê di tevahîyê de.
Crosstabs pir caran wekî "pirekê" di navbera testên danasînî û îstatîstîkî de kar dikin.
6. Testa Chi-Square ji bo Serxwebûnê
Ji bo ceribandina ka du guhêrbarên kategorîk bi hev ve girêdayî ne an serbixwe ne, ceribandina herî gelemperî ceribandina serxwebûnê ya Chi-Square (χ²) ye. Hîpoteza jêrîn ev e:
– H0: bê têkilî (serbixwe)
– H1: têkiliyek heye (ne serbixwe ye)
Eger nirxa p < asta girîngiyê be (mînak, 0,05), wê demê delîlên têkiliyek di navbera her du guherbaran de hene. Hin notên girîng: - Testa chi-square hewceyê mîqdarek têr a daneyan e, nemaze di frekansa çaverêkirî de. Ger pir xane bi hejmareke çaverêkirî ya kêm hebin, dibe ku encamên testê nederbasdar bin. - Ger nimûne piçûk be, Testa Rast a Fisher bifikirin (bi taybetî ji bo tabloyên 2x2). 7. Pîvandina Hêza Têkiliyekê: V û Phi ya Cramér Testa chi-square nîşan dide ka têkiliyek heye an na, lê ji we re nabêje ka ew çiqas xurt e. Ji bo vê armancê, mezinahiyên bandorê têne bikar anîn: - Phi (φ): ji bo tabloyên 2x2. - V ya Cramér: ji bo tabloyên ji 2x2 mezintir. V ya Cramér di navbera 0-1 de ye: - nêzîkî 0: têkiliyek qels - nêzîkî 1: têkiliyek xurt Di raporê de, ji bo şîrovekirina bêkêmasî nirxa p û mezinahiya bandorê behs bikin. 8. Analîz ji bo Daneyên Rêzkirî: Têkiliya Rêzkirî û Testên Trendê Ger daneyên we yên kategorîk rêzkirî bin, hûn dikarin rêbazên ku rêzê li ber çavan digirin bikar bînin, mînakî: - Têkiliya rêza Spearman (ji bo du guherbarên rêzkirî an hejmarên rêzkirî li hember hejmarên ne-normal) - Tau ya Kendall (alternatîfa Spearman, pir caran ji bo nimûneyên piçûk sabît) - Testên trendê di tabloyên şertî de, da ku bibînin ka qalibek zêdebûn/kêmbûnê ya domdar heye. Mînakî: gelo asta perwerdehiyê (lîse-lîse-lîsans-master-doktora) bi astên lihevhatinê (1-5) re di qalibek zêdebûnê de têkildar e? 9. Modelên Pêşbînîkirinê: Regresyona Lojîstîkî Ger armanca we ne tenê dîtina têkiliyek be, lê pêşbînîkirina kategoriyan li ser bingeha guherbarên din be, regresyonê bikar bînin:
- Regresyona lojîstîkî ya dualî: ji bo derana du-kategorî (mînak, "Bikire" li hember "Nekire"). - Regresyona lojîstîkî ya pirjimar: ji bo derana bi zêdetirî du kategoriyên nerêzkirî (mînak, "Pakêta A/B/C"). - Regresyona lojîstîkî ya rêzkirî: ji bo derana kategorîk a rêzkirî (mînak, razîbûn 1-5). Avantaja regresyona lojîstîkî: Hûn dikarin di carekê de gelek pêşbînkeran (temen, cih, kanala kirrûbirrê) têxin nav xwe û şîrovekirinek li ser bingeha rêjeya şansê bistînin, mînak, "îhtîmala kirînê di koma X de 1,8 caran zêde bûye." 10. Şîrovekirina Encaman û Nivîsandina Encaman Analîza daneyên kategorîk ên baş ji hejmaran wêdetir diçe, lê bi zelalî bersiva pirsa lêkolînê dide. Dema nivîsandina encaman: - Belavkirina sereke diyar bikin (mînak, "60% ji bersivkaran razî ne"). - Ger ceribandinek têkiliyê hebe, nirxa p û mezinahiya bandorê rapor bikin (mînak, Cramér's V). - Girîngiya pratîkî rave bikin: gelo cûdahî ji bo siyaset, stratejiya kirrûbirrê, an biryarên rêxistinî girîng e. - Heke daneyên çavdêrî ne, ji îdiayên sedeman dûr bisekinin. Têkilî her gav nayê wê wateyê ku sedeman hene. Analîzkirina daneyên kategorîk têgihîştina celebên daneyan (navdar vs. rêzdar), ravekirinek zelal a frekansan, dîtbarîkirina guncaw, xaçerêya-tabloyê, û testên îstatîstîkî yên wekî chi-square û mezinahiyên bandorê yên wekî Cramér's V hewce dike. Ji bo armancên pêşbînîkirinê, regresyona lojîstîkî amûrek pir bi hêz e. Bi van gavan, hûn dikarin daneyên nîşankirî veguherînin têgihiştinên îstatîstîkî yên saxlem ku ji bo biryardanê kêrhatî ne. Ger hûn bixwazin, ez dikarim ji we re bibim alîkar ku hûn analîzek nimûne biafirînin (mînak, bi karanîna Excel, SPSS, R, an Python) li ser bingeha daneyên we an lêkolîna dozê.