કેન્દ્રીય વૃત્તિનું માપન
કેન્દ્રીય વલણનું માપન એ આંકડાશાસ્ત્રમાં સૌથી મૂળભૂત અને મહત્વપૂર્ણ ખ્યાલોમાંની એક છે. તેનો હેતુ સરળ છે: ડેટાના સમૂહને એક જ મૂલ્યમાં સારાંશ આપવાનો જે ડેટાના કેન્દ્રનું "પ્રતિનિધિત્વ" કરે છે. બીજા શબ્દોમાં કહીએ તો, કેન્દ્રીય વલણ આપણને "લાક્ષણિક મૂલ્ય શું છે?", "આ ડેટા કયા આંકડાની આસપાસ આવે છે?", અથવા "અંદાજિત સરેરાશ શું છે?" જેવા પ્રશ્નોના જવાબ આપવામાં મદદ કરે છે. આ ખ્યાલ સંશોધન, શૈક્ષણિક મૂલ્યાંકન, વ્યવસાય વિશ્લેષણ, આરોગ્યસંભાળ અને રોજિંદા નિર્ણય લેવામાં પણ વ્યાપકપણે ઉપયોગમાં લેવાય છે.
સામાન્ય રીતે, કેન્દ્રીય વલણના ત્રણ સૌથી વધુ ઉપયોગમાં લેવાતા માપદંડો છે: સરેરાશ (સરેરાશ), મધ્યક (મધ્યમ મૂલ્ય), અને સ્થિતિ (સૌથી વધુ વારંવાર બનતું મૂલ્ય). દરેકની પોતાની ગણતરી પદ્ધતિ, ફાયદા અને મર્યાદાઓ હોય છે. દરેક માપનો ઉપયોગ ક્યારે કરવો તે સમજવાથી તમારા વિશ્લેષણને વધુ સચોટ અને ઓછું ભ્રામક બનાવવામાં મદદ મળશે.
૧. સરેરાશ (સરેરાશ)
સરેરાશ એ કેન્દ્રીય વલણનું સૌથી લોકપ્રિય માપ છે. તે બધા ડેટા મૂલ્યો ઉમેરીને અને પછી ડેટા બિંદુઓની સંખ્યા દ્વારા ભાગાકાર કરીને મેળવવામાં આવે છે. ગાણિતિક રીતે, એક ડેટા બિંદુ માટે:
\[
\bar{x} = \frac{\sum x}{n}
\]
માહિતી:
– \(\bar{x}\) = સરેરાશ
– \(\sum x\) = બધા ડેટા મૂલ્યોનો સરવાળો
– \(n\) = ડેટાનો જથ્થો
ઉદાહરણ: ધારો કે પાંચ વિદ્યાર્થીઓના પરીક્ષાના સ્કોર્સ 70, 80, 85, 90, 75 છે. સરેરાશ છે:
\[
\bar{x} = \frac{70+80+85+90+75}{5} = \frac{400}{5} = 80
\]
તો, સરેરાશ સ્કોર 80 છે.
સરેરાશ વધારાનું
1. સંપૂર્ણ ઝાંખી આપવા માટે બધા ડેટાનો ઉપયોગ કરો.
2. ગણતરી અને સમજવામાં સરળ.
૩. ભિન્નતા, પ્રમાણભૂત વિચલન, રીગ્રેશન, વગેરે જેવા અદ્યતન વિશ્લેષણમાં વ્યાપકપણે ઉપયોગમાં લેવાય છે.
સરેરાશ મર્યાદાઓ
સરેરાશ આત્યંતિક મૂલ્યો (આઉટલાયર્સ) પ્રત્યે ખૂબ જ સંવેદનશીલ છે. ઉદાહરણ તરીકે, જો એક ડેટા પોઇન્ટ ખૂબ મોટો અથવા ખૂબ નાનો હોય, તો સરેરાશ "સામાન્ય" મૂલ્યથી નોંધપાત્ર રીતે બદલાઈ શકે છે. ઉદાહરણ તરીકે, ત્રણ લોકોના આવક ડેટાને ધ્યાનમાં લો: 3 મિલિયન, 3,5 મિલિયન અને 50 મિલિયન. મોટાભાગના લોકો લગભગ 3-3,5 મિલિયન કમાય છે છતાં સરેરાશ ઊંચી છે.
તેથી, જ્યારે ડેટા પ્રમાણમાં સપ્રમાણ હોય અને તેમાં મજબૂત બાહ્યવિરોધ ન હોય ત્યારે સરેરાશ ઉપયોગ માટે યોગ્ય છે.
2. મધ્ય (મધ્યમ મૂલ્ય)
ડેટાને નાનાથી મોટામાં સૉર્ટ કર્યા પછી મધ્યક એ મધ્યમ મૂલ્ય છે. જો ડેટા બિંદુઓની સંખ્યા વિષમ હોય, તો મધ્યક એ મધ્યમ મૂલ્ય છે. જો ડેટા બિંદુઓની સંખ્યા સમાન હોય, તો મધ્યક એ બે મધ્યમ મૂલ્યોનો સરેરાશ છે.
ઉદાહરણ (વિષમ): ડેટા: 2, 3, 5, 7, 9. મધ્યક = 5.
ઉદાહરણ (સમ): ડેટા: 2, 3, 5, 7. મધ્યક = (3 + 5) / 2 = 4.
મધ્યક ફાયદા
૧. આઉટલાયરથી ખૂબ પ્રભાવિત નથી, તેથી તે છેડા પર "આઘાતજનક" ડેટા માટે વધુ સ્થિર છે.
2. અસમાન વિતરણવાળા ડેટા માટે યોગ્ય, ઉદાહરણ તરીકે આવકનો ડેટા, ઘરની કિંમતો, અથવા હોસ્પિટલમાં રહેવાનો સમયગાળો.
મધ્ય મર્યાદાઓ
મધ્યક ડેટા મૂલ્યો વિશેની બધી માહિતીનો સીધો ઉપયોગ કરતું નથી. તે ફક્ત ક્રમ અને સ્થાન પર આધાર રાખે છે, ડેટા વચ્ચેના તફાવતોની તીવ્રતા પર નહીં. જો આપણે બધા મૂલ્યોને સંપૂર્ણ રીતે ધ્યાનમાં લેવાની જરૂર હોય, ઉદાહરણ તરીકે, ચોક્કસ અદ્યતન આંકડાકીય ગણતરીઓ માટે, તો આ મધ્યકને ઓછું માહિતીપ્રદ બનાવે છે.
૩. મોડ (સૌથી વધુ વારંવાર દેખાતું મૂલ્ય)
મોડ એ મૂલ્ય છે જે ડેટા સેટમાં સૌથી વધુ વારંવાર દેખાય છે. તે સૌથી વધુ "લોકપ્રિય" અથવા સૌથી વધુ વારંવાર આવતા મૂલ્યોને ઓળખવા માટે ખૂબ ઉપયોગી છે.
ઉદાહરણ: ડેટા: 1, 2, 2, 3, 4. મોડ = 2.
કેટલાક કિસ્સાઓમાં, ડેટામાં આ હોઈ શકે છે:
- એક મોડ (યુનિમોડલ): ફક્ત એક જ મૂલ્ય મોટાભાગે દેખાય છે.
- બે મોડ્સ (બાયમોડલ): સમાન ઉચ્ચતમ આવર્તન સાથે બે મૂલ્યો છે.
– બહુવિધ સ્થિતિઓ (મલ્ટિમોડલ): બે કરતાં વધુ મૂલ્યો જે વારંવાર દેખાય છે.
- કોઈ મોડ નથી: જો બધા મૂલ્યો સમાન આવર્તન સાથે દેખાય છે.
મોડના ફાયદા
૧. શ્રેણીગત ડેટા (દા.ત. મનપસંદ રંગ, સૌથી વધુ વેચાતો ઉત્પાદન પ્રકાર) પર ઉપયોગ કરી શકાય છે, જ્યારે સરેરાશ અને મધ્યક હંમેશા શ્રેણીઓ માટે સંબંધિત નથી.
2. ખાસ કરીને ફ્રીક્વન્સી વિતરણમાં શોધવામાં સરળ.
3. "મોટાભાગના વિકલ્પો" અથવા "સૌથી સામાન્ય ઘટનાઓ" વિશે વ્યવહારુ માહિતી પ્રદાન કરો.
મોડ મર્યાદાઓ
આ મોડ અનન્ય અથવા અસ્તિત્વમાં ન પણ હોય શકે. વધુમાં, તે ડેટાના એકંદર વિતરણને ધ્યાનમાં લેતું નથી. બે અલગ અલગ ડેટા સેટમાં સમાન મોડ હોઈ શકે છે, પરંતુ તેમની વિતરણ લાક્ષણિકતાઓ ખૂબ જ અલગ છે.
4. જૂથબદ્ધ ડેટામાં કેન્દ્રીય વલણ
વ્યવહારમાં, ડેટા ઘણીવાર ફ્રીક્વન્સી ડિસ્ટ્રિબ્યુશન ટેબલ (જૂથ ડેટા) ના સ્વરૂપમાં રજૂ કરવામાં આવે છે. કેન્દ્રીય વલણની ગણતરી શક્ય છે, પરંતુ વધારાના પગલાંની જરૂર છે.
- જૂથબદ્ધ ડેટાના સરેરાશની ગણતરી વર્ગ મધ્યબિંદુ (મધ્ય-અંતરાલ મૂલ્ય) ને તેની આવર્તનથી ગુણાકાર કરીને, પછી કુલ આવર્તનથી ભાગાકાર કરીને કરવામાં આવે છે.
- જૂથબદ્ધ ડેટાના મધ્યક માટે મધ્યક વર્ગ નક્કી કરવાની જરૂર છે, એટલે કે તે વર્ગ જેમાં ડેટાની મધ્યમ સ્થિતિ હોય છે.
- જૂથબદ્ધ ડેટાનો મોડ સૌથી વધુ આવર્તન (મોડ ક્લાસ) ધરાવતા વર્ગના આધારે નક્કી કરવામાં આવે છે, પછી જૂથબદ્ધ મોડ સૂત્રનો ઉપયોગ કરીને અંદાજની ગણતરી કરી શકાય છે.
જ્યારે ડેટા એટલો મોટો હોય કે તેને અંતરાલોમાં સરળ બનાવી શકાય ત્યારે જૂથબદ્ધ ડેટા અભિગમ ઉપયોગી છે.
૫. કેન્દ્રીય વૃત્તિનું યોગ્ય માપ પસંદ કરવું
બધી પરિસ્થિતિઓ માટે કેન્દ્રીય વલણનું કોઈ "શ્રેષ્ઠ" માપ નથી. પસંદગી ડેટાના હેતુ અને પ્રકૃતિ પર આધારિત છે.
1. જો ડેટા આંકડાકીય હોય અને તેમાં ઘણા બધા આઉટલાયર ન હોય, અને વિતરણ પ્રમાણમાં સપ્રમાણ હોય તો સરેરાશનો ઉપયોગ કરો.
2. જો ડેટામાં મજબૂત બાહ્ય તફાવત હોય અથવા વિતરણ અસમાન હોય, ઉદાહરણ તરીકે સંપત્તિ, આવક અથવા કિંમત ડેટા, તો મધ્યકનો ઉપયોગ કરો.
3. જો તમે સૌથી વધુ વારંવાર દેખાતા મૂલ્યને જાણવા માંગતા હોવ અથવા ડેટા વર્ગીકૃત હોય તો મોડનો ઉપયોગ કરો.
ઉદાહરણ તરીકે, "સરેરાશ પગાર" અહેવાલમાં, સરેરાશ સામાન્ય ઝાંખી પૂરી પાડી શકે છે, પરંતુ મધ્યકને ઘણીવાર મોટાભાગના કામદારોની સ્થિતિનું વધુ પ્રતિનિધિ માનવામાં આવે છે કારણ કે તે થોડા ખૂબ ઊંચા કમાણી કરનારાઓથી ઓછો પ્રભાવિત હોય છે.
6. કેસિમ્પુલન
કેન્દ્રીય વલણના માપદંડો ડેટાનો સારાંશ આપવા અને સમજવા માટે મહત્વપૂર્ણ સાધનો છે. સરેરાશ બધા ડેટા મૂલ્યોનો ઉપયોગ કરીને સરેરાશ પ્રદાન કરે છે, પરંતુ આઉટલાયર પ્રત્યે સંવેદનશીલ છે. મધ્યક એક મધ્યમ મૂલ્ય પ્રદાન કરે છે જે આત્યંતિક મૂલ્યો માટે વધુ પ્રતિરોધક છે, જે તેને અસમપ્રમાણ ડેટા માટે યોગ્ય બનાવે છે. આ સ્થિતિ સૌથી વધુ વારંવાર બનતા મૂલ્યને સૂચવે છે અને ખાસ કરીને વર્ગીકૃત ડેટા માટે અથવા સામાન્ય વલણોને ઓળખવા માટે ઉપયોગી છે.
સારા આંકડાકીય વિશ્લેષણમાં, આ ત્રણ માપનો ઉપયોગ ઘણીવાર એકસાથે થાય છે. સરેરાશ, મધ્યક અને સ્થિતિની તુલના કરીને, આપણે ડેટાની લાક્ષણિકતાઓનું વધુ સંપૂર્ણ ચિત્ર મેળવી શકીએ છીએ - શું તે સપ્રમાણ છે, શું ત્યાં આઉટલાયર છે, અને કયા મૂલ્યો સૌથી વધુ વારંવાર થાય છે. આ સમજ આખરે આપણને વધુ જાણકાર, ડેટા-આધારિત નિર્ણયો લેવામાં મદદ કરે છે.
જો તમે ઇચ્છો તો, લેખને વધુ લાગુ પાડવા માટે હું સંપૂર્ણ ઉદાહરણ પ્રશ્નો (એકલ અને જૂથબદ્ધ ડેટા), કસરતો અને પગલું-દર-પગલાં ચર્ચાઓ ઉમેરી શકું છું.