Як разлічыць дысперсію

Як разлічыць дысперсію: поўнае кіраўніцтва

Дысперсія — гэта фундаментальная статыстыка, якая выкарыстоўваецца ў розных галінах, ад эканомікі і інжынерыі да псіхалогіі і самой статыстыкі. Яна дае інфармацыю аб тым, наколькі значэнні ў наборы дадзеных раскіданыя вакол сярэдняга значэння. У гэтым артыкуле мы разгледзім, як разлічыць глыбіню дысперсіі, ад вызначэння да практычных крокаў.

Пендахулуан

Каб зразумець дысперсію, нам трэба разумець некаторыя асноўныя паняцці статыстыкі. Дысперсія — гэта мера таго, наколькі значэнні ў наборы дадзеных адхіляюцца ад сярэдняга значэння. Дысперсія разлічваецца як сярэдняе значэнне квадратаў рознасці паміж кожным значэннем і сярэднім значэннем. Дысперсія дае ўяўленне аб «зменлівасці» дадзеных.

Вызначэнне дысперсіі

Матэматычна дысперсія — гэта:

\[ \text{Дысперсія} ( \sigma^2 ) = \frac{1}{N} \sum_{i=1}^{N} (x_i – \mu)^2 \]

Дзе:

– \( \sigma^2 \) — дысперсія папуляцыі.
– \(N \) — агульная колькасць значэнняў у генеральнай сукупнасці.
– \(x_i \) — гэта значэнне i-й асобіны.
– \( \mu \) — сярэдняе значэнне для папуляцыі.

Для выбарак формула дысперсіі крыху адрозніваецца:

\[ \text{Дысперсія выбаркі} ( s^2 ) = \frac{1}{n-1} \sum_{i=1}^{n} (x_i – \bar{x})^2 \]

Дзе:

– \(s^2 \) — дысперсія выбаркі.
– \(n \) — агульная колькасць значэнняў у выбарцы.
– \(x_i \) — значэнне i-й асобіны ў выбарцы.
– \( \bar{x} \) — сярэдняе значэнне выбаркі.

Крокі для разліку дысперсіі

Давайце разгледзім практычныя крокі па разліку дысперсіі на канкрэтным прыкладзе.

Прыклад: Разлік дысперсіі папуляцыі

Дапусцім, у нас ёсць невялікі набор даных, які складаецца з наступных значэнняў: 2, 4, 6, 8, 10.

1. Крок 1: Разлічыце сярэдняе значэнне (сярэдняе)

\[ \mu = \frac{2 + 4 + 6 + 8 + 10}{5} = 6 \]

2. Крок 2: Вылічыце розніцу кожнага значэння ад сярэдняга значэння і ўзвядзіце яе ў квадрат

\[
\begin{выраўнаваць}
(2 – 6)^2 &= (-4)^2 = 16 \\
(4 – 6)^2 &= (-2)^2 = 4 \\
(6 – 6)^2 &= 0^2 = 0 \\
(8 – 6)^2 &= 2^2 = 4 \\
(10 – 6)^2 &= 4^2 = 16 \\
\end{выраўнаваць}
\]

3. Крок 3: Складзіце ўсе квадраты рознасцяў

\[16 + 4 + 0 + 4 + 16 = 40 \]

4. Крок 4: Падзяліце суму квадратаў рознасцей на колькасць значэнняў (N)

\[ \sigma^2 = \frac{40}{5} = 8 \]

Такім чынам, дысперсія папуляцыі гэтых дадзеных роўная 8.

Прыклад: Разлік дысперсіі выбаркі

Цяпер дапусцім, што мы возьмем невялікую выбарку з прыведзенага вышэй набору дадзеных: 2, 4, 6.

1. Крок 1: Разлічыце сярэдняе значэнне выбаркі

\[ \bar{x} = \frac{2 + 4 + 6}{3} = 4 \]

2. Крок 2: Вылічыце розніцу кожнага значэння ад сярэдняга значэння і ўзвядзіце яе ў квадрат

\[
\begin{выраўнаваць}
(2 – 4)^2 &= (-2)^2 = 4 \\
(4 – 4)^2 &= 0^2 = 0 \\
(6 – 4)^2 &= 2^2 = 4 \\
\end{выраўнаваць}
\]

3. Крок 3: Складзіце ўсе квадраты рознасцяў

\[4 + 0 + 4 = 8 \]

4. Крок 4: Падзяліце суму квадратаў рознасцей на (n – 1)

\[s^2 = \frac{8}{3-1} = \frac{8}{2} = 4 \]

Такім чынам, дысперсія выбаркі гэтых дадзеных роўная 4.

Дысперсія ў папуляцыі і выбарцы

Важна разумець розніцу паміж дысперсіяй папуляцыі і дысперсіяй выбаркі. Дысперсія папуляцыі вымярае распаўсюджванне дадзеных па ўсёй папуляцыі, у той час як дысперсія выбаркі вымярае распаўсюджванне ўнутры падмноства (выбаркі) папуляцыі. У многіх выпадках дысперсія выбаркі выкарыстоўваецца для ацэнкі дысперсіі папуляцыі. Дзяленне на \( (n-1) \) пры разліку дысперсіі выбаркі памяншае зрушэнне ў ацэнцы дысперсіі папуляцыі.

Прымяненне дысперсіі

Дысперсія выкарыстоўваецца ў розных сферах прымянення, такіх як:

1. Аналіз фінансавых рызык: У фінансах дысперсія выкарыстоўваецца для вымярэння рызыкі і кіравання інвестыцыйнымі партфелямі. Большая дысперсія азначае больш рызыкоўныя інвестыцыі.

2. Грамадскія навукі: У псіхалагічных або сацыялагічных даследаваннях дысперсія выкарыстоўваецца для вымярэння адрозненняў паміж групамі насельніцтва.

3. Кантроль якасці: У вытворчасці адхіленні выкарыстоўваюцца для маніторынгу і кантролю якасці прадукцыі.

4. Эксперыментальная статыстыка: выкарыстоўваецца для аналізу эксперыментальных вынікаў і вызначэння значнасці адрозненняў.

Дысперсія і стандартнае адхіленне

Дысперсія часта выкарыстоўваецца разам са стандартным адхіленнем, якое з'яўляецца квадратным коранем з дысперсіі. Стандартнае адхіленне забяспечвае больш прамую і лягчэй інтэрпрэтаваную меру рассейвання, чым дысперсія. Раўнанне паміж імі выглядае наступным чынам:

\[ \text{Стандартнае адхіленне} (\sigma) = \sqrt{\text{Дысперсія} (\sigma^2)} \]

Выснова

Разлік дысперсіі з'яўляецца найважнейшай часткай статыстычнага аналізу, які забяспечвае меру распаўсюджвання або рассейвання ў наборы дадзеных. Разумеючы асноўныя паняцці і тое, як разлічваць дысперсію, мы можам лепш аналізаваць дадзеныя, ацэньваць рызыку і прымаць больш абгрунтаваныя рашэнні.

Незалежна ад таго, ці выкарыстоўваем мы дысперсію папуляцыі для больш навуковага аналізу, ці дысперсію выбаркі для ацэнкі з падмноства дадзеных, глыбокае разуменне дысперсіі дапамагае нам зразумець разнастайнасць дадзеных і прымяніць яе да розных рэальных сітуацый. Спадзяемся, што гэты артыкул з'яўляецца практычным і карысным кіраўніцтвам па разуменні і разліку дысперсіі.

Правільны каментар