ಮೋಡ್ ಮತ್ತು ಮೀಡಿಯನ್: ಅಂಕಿಅಂಶಗಳಲ್ಲಿ ವಿವರಣೆ ಮತ್ತು ಅನ್ವಯ
ಸಂಖ್ಯಾಶಾಸ್ತ್ರವು ಗಣಿತಶಾಸ್ತ್ರದ ಒಂದು ಶಾಖೆಯಾಗಿದ್ದು ಅದು ದತ್ತಾಂಶದ ಸಂಗ್ರಹಣೆ, ವಿಶ್ಲೇಷಣೆ, ವ್ಯಾಖ್ಯಾನ, ಪ್ರಸ್ತುತಿ ಮತ್ತು ಸಂಘಟನೆಯೊಂದಿಗೆ ವ್ಯವಹರಿಸುತ್ತದೆ. ಅಂಕಿಅಂಶಗಳಲ್ಲಿ, ದತ್ತಾಂಶದ ಪ್ರಸರಣದ ವಿವಿಧ ಅಳತೆಗಳು ಮತ್ತು ಕೇಂದ್ರ ನಿರ್ಧಾರಕಗಳನ್ನು ಅವುಗಳನ್ನು ವಿಶ್ಲೇಷಿಸಲು ಮತ್ತು ಅರ್ಥಮಾಡಿಕೊಳ್ಳಲು ಬಳಸಲಾಗುತ್ತದೆ. ಎರಡು ಮೂಲಭೂತ ಮತ್ತು ಪ್ರಮುಖವಾದವು ಮೋಡ್ ಮತ್ತು ಸರಾಸರಿ. ಈ ಲೇಖನವು ಮೋಡ್ ಮತ್ತು ಸರಾಸರಿ ಎಂದರೇನು, ಅವುಗಳನ್ನು ಹೇಗೆ ಲೆಕ್ಕ ಹಾಕುವುದು ಮತ್ತು ದತ್ತಾಂಶ ವಿಶ್ಲೇಷಣೆಯಲ್ಲಿ ಅವುಗಳ ಪ್ರಾಮುಖ್ಯತೆಯನ್ನು ವಿವರಿಸುತ್ತದೆ.
ಮೋಡ್ ಎಂದರೇನು?
ಡೇಟಾ ಸೆಟ್ನಲ್ಲಿ ಹೆಚ್ಚಾಗಿ ಸಂಭವಿಸುವ ಮೌಲ್ಯವೇ ಮೋಡ್. ತಾಂತ್ರಿಕವಾಗಿ ಹೇಳುವುದಾದರೆ, ಡೇಟಾ ವಿತರಣೆಯಲ್ಲಿ ಅತ್ಯಧಿಕ ಆವರ್ತನವನ್ನು ಹೊಂದಿರುವ ಮೌಲ್ಯ ಅಥವಾ ವರ್ಗವೇ ಮೋಡ್ ಆಗಿದೆ. ವರ್ಗೀಕರಣ, ಆರ್ಡಿನಲ್, ಮಧ್ಯಂತರ ಮತ್ತು ಅನುಪಾತ ಡೇಟಾಗೆ ಮೋಡ್ಗಳನ್ನು ಬಳಸಬಹುದು. ಸರಾಸರಿ ಮತ್ತು ಸರಾಸರಿಗಿಂತ ಭಿನ್ನವಾಗಿ, ಮೋಡ್ ಯಾವಾಗಲೂ ವಿಶಿಷ್ಟವಾಗಿರುವುದಿಲ್ಲ. ಕೆಲವು ಸಂದರ್ಭಗಳಲ್ಲಿ, ಎಲ್ಲಾ ಮೌಲ್ಯಗಳು ಸಮಾನ ಆವರ್ತನದೊಂದಿಗೆ ಸಂಭವಿಸಿದರೆ ಡೇಟಾವು ಒಂದಕ್ಕಿಂತ ಹೆಚ್ಚು ಮೋಡ್ಗಳನ್ನು (ಬೈಮೋಡಲ್ ಅಥವಾ ಮಲ್ಟಿಮೋಡಲ್) ಹೊಂದಿರಬಹುದು ಅಥವಾ ಯಾವುದೇ ಮೋಡ್ ಅನ್ನು ಹೊಂದಿರುವುದಿಲ್ಲ.
ಮೋಡ್ ಅನ್ನು ಹೇಗೆ ಲೆಕ್ಕ ಹಾಕುವುದು
ಮೋಡ್ ಅನ್ನು ಲೆಕ್ಕಾಚಾರ ಮಾಡುವುದು ತುಂಬಾ ಸರಳವಾಗಿದೆ. ಡೇಟಾದಲ್ಲಿ ಹೆಚ್ಚಾಗಿ ಕಾಣಿಸಿಕೊಳ್ಳುವ ಮೌಲ್ಯವನ್ನು ನೀವು ಗುರುತಿಸಬೇಕಾಗಿದೆ. ಸರಳ ಉದಾಹರಣೆ ಇಲ್ಲಿದೆ:
ನಮಗೆ ಈ ಕೆಳಗಿನ ಡೇಟಾ ಸೆಟ್ ಇದೆ ಎಂದು ಹೇಳೋಣ: 3, 7, 5, 9, 7, 6, 7, 2.
ಈ ಡೇಟಾ ಸೆಟ್ನಲ್ಲಿ, 7 ಮೌಲ್ಯವು ಇತರ ಯಾವುದೇ ಮೌಲ್ಯಕ್ಕಿಂತ ಹೆಚ್ಚಾಗಿ ಮೂರು ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ. ಆದ್ದರಿಂದ, ಈ ಡೇಟಾ ಸೆಟ್ನ ಮೋಡ್ 7 ಆಗಿದೆ.
ಹೆಚ್ಚು ಸಂಕೀರ್ಣವಾದ ಡೇಟಾ ಅಥವಾ ವರ್ಗೀಯ ಡೇಟಾಕ್ಕಾಗಿ, ಪ್ರತಿ ಮೌಲ್ಯದ ಆವರ್ತನಗಳನ್ನು ಹೆಚ್ಚು ಸುಲಭವಾಗಿ ಗುರುತಿಸಲು ನೀವು ಅವುಗಳನ್ನು ಸಂಘಟಿಸಬೇಕಾಗಬಹುದು.
ವರ್ಗೀಯ ದತ್ತಾಂಶದ ಉದಾಹರಣೆ:
ಹೆಚ್ಚು ಆದ್ಯತೆಯ ಕಾರು ಬಣ್ಣಗಳನ್ನು ಕಂಡುಹಿಡಿಯಲು ಒಂದು ಸಮೀಕ್ಷೆಯನ್ನು ನಡೆಸಲಾಯಿತು: ಕೆಂಪು, ನೀಲಿ, ಕಪ್ಪು, ಬಿಳಿ, ಕಪ್ಪು, ನೀಲಿ, ನೀಲಿ.
ಈ ಉದಾಹರಣೆಯಲ್ಲಿ:
– ಕೆಂಪು 1 ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ
– ನೀಲಿ 3 ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ
– ಕಪ್ಪು 2 ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ
– ಬಿಳಿ ಬಣ್ಣವು 1 ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ
ಈ ಡೇಟಾದ ಮೋಡ್ ನೀಲಿ ಬಣ್ಣದ್ದಾಗಿದೆ, ಏಕೆಂದರೆ ಇದು ಹೆಚ್ಚಾಗಿ ಉಲ್ಲೇಖಿಸಲಾದ ಬಣ್ಣವಾಗಿದೆ (3 ಬಾರಿ).
ಮೋಡ್ ವಿಶಿಷ್ಟವಾಗಿಲ್ಲದಿದ್ದಾಗ ಅಥವಾ ಅಸ್ತಿತ್ವದಲ್ಲಿಲ್ಲದಿದ್ದಾಗ
ಕೆಲವು ಸಂದರ್ಭಗಳಲ್ಲಿ, ಡೇಟಾವು ಒಂದಕ್ಕಿಂತ ಹೆಚ್ಚು ಮೋಡ್ಗಳನ್ನು ಹೊಂದಿರಬಹುದು ಅಥವಾ ಮೋಡ್ಗಳೇ ಇಲ್ಲದಿರಬಹುದು. ಉದಾಹರಣೆ:
ಬೈಮೋಡಲ್ ಅಥವಾ ಮಲ್ಟಿಮೋಡಲ್:
ಡೇಟಾಸೆಟ್: 4, 4, 5, 5, 6, 6, 7
ಈ ಉದಾಹರಣೆಯಲ್ಲಿ, 4, 5 ಮತ್ತು 6 ಮೌಲ್ಯಗಳು ಪ್ರತಿಯೊಂದೂ ಎರಡು ಬಾರಿ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತವೆ. ಆದ್ದರಿಂದ, ಈ ಡೇಟಾಸೆಟ್ 4, 5 ಮತ್ತು 6 ವಿಧಾನಗಳೊಂದಿಗೆ ಬಹುಮಾದರಿಯಾಗಿದೆ.
ಮೋಡ್ ಇಲ್ಲ:
ಡೇಟಾ ಸೆಟ್: 1, 2, 3, 4, 5
ಪ್ರತಿಯೊಂದು ಮೌಲ್ಯವು ಒಮ್ಮೆ ಮಾತ್ರ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ, ಆದ್ದರಿಂದ ಈ ಡೇಟಾಸೆಟ್ನಲ್ಲಿ ಯಾವುದೇ ಮೋಡ್ ಇಲ್ಲ.
ಮಧ್ಯಮ ಎಂದರೇನು?
ವಿಂಗಡಿಸಲಾದ ದತ್ತಾಂಶ ಗುಂಪಿನಲ್ಲಿ ಮಧ್ಯದ ಮೌಲ್ಯವು ಮಧ್ಯದ ಮೌಲ್ಯವಾಗಿದೆ. ಇದು ದತ್ತಾಂಶ ಗುಂಪನ್ನು ಎರಡು ಸಮಾನ ಭಾಗಗಳಾಗಿ ವಿಂಗಡಿಸುತ್ತದೆ, ಅರ್ಧದಷ್ಟು ಮೌಲ್ಯಗಳು ಮಧ್ಯದ ಕೆಳಗೆ ಮತ್ತು ಉಳಿದ ಅರ್ಧವು ಮಧ್ಯದ ಮೇಲೆ ಬೀಳುತ್ತದೆ. ಸರಾಸರಿಯನ್ನು ಹೆಚ್ಚಾಗಿ ಬಳಸಲಾಗುತ್ತದೆ ಏಕೆಂದರೆ ಇದು ತೀವ್ರ ಮೌಲ್ಯಗಳು ಅಥವಾ ಸರಾಸರಿಯಂತಹ ಹೊರಗಣಗಳಿಂದ ಪ್ರಭಾವಿತವಾಗುವುದಿಲ್ಲ, ಹೀಗಾಗಿ ದತ್ತಾಂಶವು ದೊಡ್ಡ ವಿಚಲನಗಳನ್ನು ಹೊಂದಿರುವಾಗ ದತ್ತಾಂಶ ವಿತರಣೆಯ ಕೇಂದ್ರದ ಉತ್ತಮ ಸೂಚನೆಯನ್ನು ಒದಗಿಸುತ್ತದೆ.
ಮಧ್ಯಮವನ್ನು ಹೇಗೆ ಲೆಕ್ಕ ಹಾಕುವುದು
ಸರಾಸರಿಯನ್ನು ಲೆಕ್ಕಾಚಾರ ಮಾಡುವ ಹಂತಗಳು ಈ ಕೆಳಗಿನಂತಿವೆ:
1. ಡೇಟಾವನ್ನು ಆರೋಹಣ ಕ್ರಮದಲ್ಲಿ ವಿಂಗಡಿಸಿ.
2. ದತ್ತಾಂಶಗಳ ಸಂಖ್ಯೆ (N) ಬೆಸವಾಗಿದ್ದರೆ, ಮಧ್ಯಾಂಕವು ಮಧ್ಯದ ಸ್ಥಾನದಲ್ಲಿರುವ ಮೌಲ್ಯವಾಗಿರುತ್ತದೆ.
3. ದತ್ತಾಂಶಗಳ ಸಂಖ್ಯೆ (N) ಸಮವಾಗಿದ್ದರೆ, ಮಧ್ಯದಲ್ಲಿರುವ ಎರಡು ಮೌಲ್ಯಗಳ ಸರಾಸರಿ ಸರಾಸರಿಯಾಗಿರುತ್ತದೆ.
ವಿವರಣೆ:
ಬೆಸ ಸಂಖ್ಯೆಯೊಂದಿಗೆ ಡೇಟಾಸೆಟ್:
ಡೇಟಾ ಸೆಟ್: 3, 7, 5, 9, 6
ವಿಂಗಡಿಸಿ: 3, 5, 6, 7, 9
ಸರಾಸರಿ: 6 (ಮಧ್ಯದಲ್ಲಿರುವ ಮೌಲ್ಯ)
ಸಮ ಸಂಖ್ಯೆಯೊಂದಿಗೆ ಡೇಟಾಸೆಟ್:
ಡೇಟಾಸೆಟ್: 3, 7, 5, 9, 6, 8
ವಿಂಗಡಿಸಿ: 3, 5, 6, 7, 8, 9
ಸರಾಸರಿ: (6 + 7) / 2 = 6.5
ವರ್ಗೀಯ ದತ್ತಾಂಶದಲ್ಲಿ ಸರಾಸರಿ
ಸರಾಸರಿಯನ್ನು ಹೆಚ್ಚಾಗಿ ನಿರಂತರ ದತ್ತಾಂಶ ಅಥವಾ ಆರ್ಡಿನಲ್ ದತ್ತಾಂಶಕ್ಕೆ ಅನ್ವಯಿಸಲಾಗುತ್ತದೆಯಾದರೂ, ಸ್ಪಷ್ಟ ಕ್ರಮದೊಂದಿಗೆ ವರ್ಗೀಕೃತ ದತ್ತಾಂಶಕ್ಕೂ ಇದನ್ನು ಬಳಸಬಹುದು.
ವರ್ಗೀಯ (ಸಾಮಾನ್ಯ) ದತ್ತಾಂಶದ ಉದಾಹರಣೆಗಳು:
ಚಲನಚಿತ್ರ ರೇಟಿಂಗ್: ಒಳ್ಳೆಯದು, ತುಂಬಾ ಒಳ್ಳೆಯದು, ನ್ಯಾಯೋಚಿತ, ತುಂಬಾ ಒಳ್ಳೆಯದು, ಒಳ್ಳೆಯದು
ಶ್ರೇಯಾಂಕದ ಪ್ರಕಾರ ವಿಂಗಡಿಸಿ: ನ್ಯಾಯೋಚಿತ, ಒಳ್ಳೆಯದು, ಒಳ್ಳೆಯದು, ತುಂಬಾ ಒಳ್ಳೆಯದು, ಅತ್ಯುತ್ತಮ
ಸರಾಸರಿ: ಒಳ್ಳೆಯದು (ಮೂರನೇ ಮಧ್ಯಮ ಮೌಲ್ಯ)
ಮಧ್ಯಮ ವರ್ಗದ ಸಾಮರ್ಥ್ಯಗಳು ಮತ್ತು ದೌರ್ಬಲ್ಯಗಳು
ಮೀಡಿಯನ್ನ ಪ್ರಮುಖ ಪ್ರಯೋಜನಗಳಲ್ಲಿ ಒಂದು ಹೊರಗಿನವರಿಗೆ ಅದರ ಸೂಕ್ಷ್ಮತೆ. ಉದಾಹರಣೆಗೆ, ನಮ್ಮಲ್ಲಿ ಆದಾಯದ ಡೇಟಾಸೆಟ್ ಇದೆ ಮತ್ತು ಅತ್ಯಂತ ಹೆಚ್ಚಿನ ಆದಾಯ ಹೊಂದಿರುವ CEO ಸೇರಿದ್ದಾರೆ ಎಂದು ಹೇಳೋಣ. ಮೀಡಿಯನ್ ಇನ್ನೂ ಸರಾಸರಿಗಿಂತ ಕೇಂದ್ರ ಆದಾಯದ ಹೆಚ್ಚು ವಾಸ್ತವಿಕ ಚಿತ್ರವನ್ನು ಒದಗಿಸುತ್ತದೆ, ಇದು ತೀವ್ರ ಮೌಲ್ಯಗಳಿಂದ ವಿರೂಪಗೊಳ್ಳುತ್ತದೆ. ಆದಾಗ್ಯೂ, ಮೀಡಿಯನ್ನ ಅನಾನುಕೂಲವೆಂದರೆ ಸಣ್ಣ ಡೇಟಾಸೆಟ್ಗಳಲ್ಲಿ, ಕಾಣೆಯಾದ ಅಥವಾ ತಪ್ಪಾದ ಡೇಟಾವು ಫಲಿತಾಂಶಗಳ ಮೇಲೆ ಗಮನಾರ್ಹವಾಗಿ ಪರಿಣಾಮ ಬೀರುತ್ತದೆ.
ಮೋಡ್ vs ಮೀಡಿಯನ್ vs ಮೀನ್
ಮೋಡ್, ಮೀಡಿಯನ್ ಮತ್ತು ಮೀನ್ ಎರಡೂ ಕೇಂದ್ರ ಪ್ರವೃತ್ತಿಯ ಅಳತೆಗಳಾಗಿದ್ದು, ದತ್ತಾಂಶ ವಿತರಣೆಯ ಗುಣಲಕ್ಷಣಗಳ ಬಗ್ಗೆ ಪ್ರಮುಖ ಮಾಹಿತಿಯನ್ನು ಒದಗಿಸುತ್ತವೆ.
– ಸರಾಸರಿ: ಎಲ್ಲಾ ದತ್ತಾಂಶಗಳ ಅಂಕಗಣಿತದ ಸರಾಸರಿ. ಹೊರಗಿನವುಗಳಿಗೆ ಸೂಕ್ಷ್ಮವಾಗಿರುತ್ತದೆ.
– ಮಧ್ಯಾಂಕ: ವಿಂಗಡಿಸಲಾದ ಡೇಟಾದ ಮಧ್ಯದ ಮೌಲ್ಯ. ಹೊರಗಿನವುಗಳಿಗೆ ಸೂಕ್ಷ್ಮವಾಗಿರುವುದಿಲ್ಲ.
– ಮೋಡ್: ಹೆಚ್ಚಾಗಿ ಕಾಣಿಸಿಕೊಳ್ಳುವ ಮೌಲ್ಯ. ವರ್ಗೀಕೃತ ದತ್ತಾಂಶಕ್ಕೆ ಉಪಯುಕ್ತ.
ಪ್ರತಿಯೊಂದೂ ತನ್ನದೇ ಆದ ಉಪಯೋಗಗಳು ಮತ್ತು ಅನಾನುಕೂಲಗಳನ್ನು ಹೊಂದಿದೆ, ಮತ್ತು ಕೆಲವೊಮ್ಮೆ ಹೆಚ್ಚು ಸಮಗ್ರ ಚಿತ್ರವನ್ನು ಒದಗಿಸಲು ಒಟ್ಟಿಗೆ ಬಳಸಲಾಗುತ್ತದೆ.
ಸರಿಯಾದ ಗಾತ್ರವನ್ನು ಆರಿಸುವುದು
ಕೇಂದ್ರ ಪ್ರವೃತ್ತಿಯ ಸೂಕ್ತ ಅಳತೆಯನ್ನು ಆಯ್ಕೆ ಮಾಡುವುದು ದತ್ತಾಂಶದ ಪ್ರಕಾರ ಮತ್ತು ವಿಶ್ಲೇಷಣೆಯ ಉದ್ದೇಶವನ್ನು ಅವಲಂಬಿಸಿರುತ್ತದೆ.
– ದತ್ತಾಂಶವು ಹೊರಗಣ ಮೌಲ್ಯಗಳನ್ನು ಹೊಂದಿದ್ದರೆ ಅಥವಾ ಸಾಮಾನ್ಯವಾಗಿ ವಿತರಿಸಲ್ಪಡದಿದ್ದರೆ, ಸರಾಸರಿ ಮೌಲ್ಯವು ಹೆಚ್ಚು ಸೂಕ್ತವಾಗಿರುತ್ತದೆ.
– ನೀವು ಅತ್ಯಂತ ಸಾಮಾನ್ಯ ಮೌಲ್ಯ ಅಥವಾ ಪ್ರಬಲ ವರ್ಗದಲ್ಲಿ ಆಸಕ್ತಿ ಹೊಂದಿದ್ದರೆ, ಮೋಡ್ ಹೆಚ್ಚು ಉಪಯುಕ್ತವಾಗಿರುತ್ತದೆ.
– ದತ್ತಾಂಶವು ಸಾಮಾನ್ಯವಾಗಿ ಬಾಹ್ಯರೇಖೆಗಳಿಲ್ಲದೆ ವಿತರಿಸಲ್ಪಟ್ಟರೆ, ಸರಾಸರಿಯು ಉತ್ತಮ ಪ್ರಾತಿನಿಧ್ಯವನ್ನು ಒದಗಿಸುತ್ತದೆ.
ಉದಾಹರಣೆಗೆ, ಆಸ್ತಿ ಮಾರುಕಟ್ಟೆ ವಿಶ್ಲೇಷಣೆಯಲ್ಲಿ, ತೀವ್ರ ಬೆಲೆ ವ್ಯತ್ಯಾಸಗಳಿಂದಾಗಿ ಮನೆ ಬೆಲೆಗಳನ್ನು ವಿವರಿಸಲು ಸರಾಸರಿಯನ್ನು ಹೆಚ್ಚಾಗಿ ಬಳಸಲಾಗುತ್ತದೆ. ಸಾರ್ವಜನಿಕ ಅಭಿಪ್ರಾಯ ಸಮೀಕ್ಷೆಗಳಲ್ಲಿ, ಅತ್ಯಂತ ಜನಪ್ರಿಯ ಆಯ್ಕೆಯನ್ನು ಗುರುತಿಸಲು ಈ ವಿಧಾನವನ್ನು ಬಳಸಬಹುದು.
ತೀರ್ಮಾನ
ಅಂಕಿಅಂಶಗಳಲ್ಲಿ ಮೋಡ್ ಮತ್ತು ಮೀಡಿಯನ್ ಎರಡು ಅತ್ಯಂತ ಉಪಯುಕ್ತ ಕೇಂದ್ರ ಪ್ರವೃತ್ತಿಯ ಅಳತೆಗಳಾಗಿವೆ. ಅವು ವಿಭಿನ್ನ ಮಾಹಿತಿಯನ್ನು ಒದಗಿಸಿದರೂ, ಅವು ಡೇಟಾ ಸೆಟ್ನ ಮುಖ್ಯ ಗುಣಲಕ್ಷಣಗಳನ್ನು ಸರಳೀಕರಿಸಬಹುದು ಮತ್ತು ಸಂಕ್ಷೇಪಿಸಬಹುದು, ಆ ಡೇಟಾದ ಆಧಾರದ ಮೇಲೆ ನಿರ್ಧಾರ ತೆಗೆದುಕೊಳ್ಳುವಿಕೆಯಲ್ಲಿ ಸಹಾಯ ಮಾಡುತ್ತವೆ. ಸರಾಸರಿ ಜೊತೆಗೆ ಅವುಗಳ ಉಪಸ್ಥಿತಿಯು ಸಂಶೋಧಕರು ಮತ್ತು ವಿಶ್ಲೇಷಕರು ತಾವು ಅಧ್ಯಯನ ಮಾಡುತ್ತಿರುವ ಡೇಟಾದ ಸಂಪೂರ್ಣ ಚಿತ್ರವನ್ನು ಪಡೆಯಲು ಅನುವು ಮಾಡಿಕೊಡುತ್ತದೆ.