Як разлічыць дысперсію: поўнае кіраўніцтва
Дысперсія — гэта фундаментальная статыстыка, якая выкарыстоўваецца ў розных галінах, ад эканомікі і інжынерыі да псіхалогіі і самой статыстыкі. Яна дае інфармацыю аб тым, наколькі значэнні ў наборы дадзеных раскіданыя вакол сярэдняга значэння. У гэтым артыкуле мы разгледзім, як разлічыць глыбіню дысперсіі, ад вызначэння да практычных крокаў.
Пендахулуан
Каб зразумець дысперсію, нам трэба разумець некаторыя асноўныя паняцці статыстыкі. Дысперсія — гэта мера таго, наколькі значэнні ў наборы дадзеных адхіляюцца ад сярэдняга значэння. Дысперсія разлічваецца як сярэдняе значэнне квадратаў рознасці паміж кожным значэннем і сярэднім значэннем. Дысперсія дае ўяўленне аб «зменлівасці» дадзеных.
Вызначэнне дысперсіі
Матэматычна дысперсія — гэта:
\[ \text{Дысперсія} ( \sigma^2 ) = \frac{1}{N} \sum_{i=1}^{N} (x_i – \mu)^2 \]
Дзе:
– \( \sigma^2 \) — дысперсія папуляцыі.
– \(N \) — агульная колькасць значэнняў у генеральнай сукупнасці.
– \(x_i \) — гэта значэнне i-й асобіны.
– \( \mu \) — сярэдняе значэнне для папуляцыі.
Для выбарак формула дысперсіі крыху адрозніваецца:
\[ \text{Дысперсія выбаркі} ( s^2 ) = \frac{1}{n-1} \sum_{i=1}^{n} (x_i – \bar{x})^2 \]
Дзе:
– \(s^2 \) — дысперсія выбаркі.
– \(n \) — агульная колькасць значэнняў у выбарцы.
– \(x_i \) — значэнне i-й асобіны ў выбарцы.
– \( \bar{x} \) — сярэдняе значэнне выбаркі.
Крокі для разліку дысперсіі
Давайце разгледзім практычныя крокі па разліку дысперсіі на канкрэтным прыкладзе.
Прыклад: Разлік дысперсіі папуляцыі
Дапусцім, у нас ёсць невялікі набор даных, які складаецца з наступных значэнняў: 2, 4, 6, 8, 10.
1. Крок 1: Разлічыце сярэдняе значэнне (сярэдняе)
\[ \mu = \frac{2 + 4 + 6 + 8 + 10}{5} = 6 \]
2. Крок 2: Вылічыце розніцу кожнага значэння ад сярэдняга значэння і ўзвядзіце яе ў квадрат
\[
\begin{выраўнаваць}
(2 – 6)^2 &= (-4)^2 = 16 \\
(4 – 6)^2 &= (-2)^2 = 4 \\
(6 – 6)^2 &= 0^2 = 0 \\
(8 – 6)^2 &= 2^2 = 4 \\
(10 – 6)^2 &= 4^2 = 16 \\
\end{выраўнаваць}
\]
3. Крок 3: Складзіце ўсе квадраты рознасцяў
\[16 + 4 + 0 + 4 + 16 = 40 \]
4. Крок 4: Падзяліце суму квадратаў рознасцей на колькасць значэнняў (N)
\[ \sigma^2 = \frac{40}{5} = 8 \]
Такім чынам, дысперсія папуляцыі гэтых дадзеных роўная 8.
Прыклад: Разлік дысперсіі выбаркі
Цяпер дапусцім, што мы возьмем невялікую выбарку з прыведзенага вышэй набору дадзеных: 2, 4, 6.
1. Крок 1: Разлічыце сярэдняе значэнне выбаркі
\[ \bar{x} = \frac{2 + 4 + 6}{3} = 4 \]
2. Крок 2: Вылічыце розніцу кожнага значэння ад сярэдняга значэння і ўзвядзіце яе ў квадрат
\[
\begin{выраўнаваць}
(2 – 4)^2 &= (-2)^2 = 4 \\
(4 – 4)^2 &= 0^2 = 0 \\
(6 – 4)^2 &= 2^2 = 4 \\
\end{выраўнаваць}
\]
3. Крок 3: Складзіце ўсе квадраты рознасцяў
\[4 + 0 + 4 = 8 \]
4. Крок 4: Падзяліце суму квадратаў рознасцей на (n – 1)
\[s^2 = \frac{8}{3-1} = \frac{8}{2} = 4 \]
Такім чынам, дысперсія выбаркі гэтых дадзеных роўная 4.
Дысперсія ў папуляцыі і выбарцы
Важна разумець розніцу паміж дысперсіяй папуляцыі і дысперсіяй выбаркі. Дысперсія папуляцыі вымярае распаўсюджванне дадзеных па ўсёй папуляцыі, у той час як дысперсія выбаркі вымярае распаўсюджванне ўнутры падмноства (выбаркі) папуляцыі. У многіх выпадках дысперсія выбаркі выкарыстоўваецца для ацэнкі дысперсіі папуляцыі. Дзяленне на \( (n-1) \) пры разліку дысперсіі выбаркі памяншае зрушэнне ў ацэнцы дысперсіі папуляцыі.
Прымяненне дысперсіі
Дысперсія выкарыстоўваецца ў розных сферах прымянення, такіх як:
1. Аналіз фінансавых рызык: У фінансах дысперсія выкарыстоўваецца для вымярэння рызыкі і кіравання інвестыцыйнымі партфелямі. Большая дысперсія азначае больш рызыкоўныя інвестыцыі.
2. Грамадскія навукі: У псіхалагічных або сацыялагічных даследаваннях дысперсія выкарыстоўваецца для вымярэння адрозненняў паміж групамі насельніцтва.
3. Кантроль якасці: У вытворчасці адхіленні выкарыстоўваюцца для маніторынгу і кантролю якасці прадукцыі.
4. Эксперыментальная статыстыка: выкарыстоўваецца для аналізу эксперыментальных вынікаў і вызначэння значнасці адрозненняў.
Дысперсія і стандартнае адхіленне
Дысперсія часта выкарыстоўваецца разам са стандартным адхіленнем, якое з'яўляецца квадратным коранем з дысперсіі. Стандартнае адхіленне забяспечвае больш прамую і лягчэй інтэрпрэтаваную меру рассейвання, чым дысперсія. Раўнанне паміж імі выглядае наступным чынам:
\[ \text{Стандартнае адхіленне} (\sigma) = \sqrt{\text{Дысперсія} (\sigma^2)} \]
Выснова
Разлік дысперсіі з'яўляецца найважнейшай часткай статыстычнага аналізу, які забяспечвае меру распаўсюджвання або рассейвання ў наборы дадзеных. Разумеючы асноўныя паняцці і тое, як разлічваць дысперсію, мы можам лепш аналізаваць дадзеныя, ацэньваць рызыку і прымаць больш абгрунтаваныя рашэнні.
Незалежна ад таго, ці выкарыстоўваем мы дысперсію папуляцыі для больш навуковага аналізу, ці дысперсію выбаркі для ацэнкі з падмноства дадзеных, глыбокае разуменне дысперсіі дапамагае нам зразумець разнастайнасць дадзеных і прымяніць яе да розных рэальных сітуацый. Спадзяемся, што гэты артыкул з'яўляецца практычным і карысным кіраўніцтвам па разуменні і разліку дысперсіі.