Ako vypočítať štandardnú odchýlku

Ako vypočítať štandardnú odchýlku

Štandardná odchýlka je jedným z najčastejšie používaných štatistických ukazovateľov na určenie, ako veľmi sa dáta „rozptyľujú“ od svojho priemeru. V reálnom živote nám štandardná odchýlka pomáha pochopiť stabilitu alebo variáciu javu: napríklad variácie vo výsledkoch testov, výkyvy predaja, rozdiely vo výške a dokonca aj riziká vo finančných údajoch. Čím menšia je štandardná odchýlka, tým bližšie sú dáta k priemeru. Naopak, veľká štandardná odchýlka naznačuje, že dáta sú ďaleko od priemeru a majú vysokú variáciu.

Tento článok sa bude zaoberať významom štandardnej odchýlky, použitým vzorcom a krokmi na jej manuálny výpočet prostredníctvom ľahko zrozumiteľných príkladov.

1. Definícia štandardnej odchýlky

Štandardná odchýlka je druhá odmocnina rozptylu. Samotný rozptyl je priemer druhých mocnín rozdielov medzi jednotlivými dátovými bodmi a priemerom. Prečo používať druhú mocninu? Pretože rozdiely medzi dátovými bodmi a priemerom môžu byť buď záporné, alebo kladné. Ak sa sčítajú priamo, záporné a kladné rozdiely sa môžu navzájom vyrušiť, čo vedie k zavádzajúcim výsledkom. Umocnením rozdielov sa všetky hodnoty stanú kladnými, čo umožňuje presnejšie meranie rozloženia údajov.

Jednoducho:

– Rozptyl = miera rozptylu v „štvorcových“ jednotkách.
– Štandardná odchýlka = miera rozptylu, ktorá sa vrátila k pôvodným jednotkám údajov.

Príklad: ak sú údaje vo forme skóre testov (bodových jednotiek), rozptyl bude v bodoch, zatiaľ čo štandardná odchýlka bude opäť v bodoch, čo uľahčí interpretáciu.

2. Štandardná odchýlka populácie verzus vzorka

Pred výpočtom je dôležité vedieť, aký typ údajov máte k dispozícii:

PREČÍTAJTE SI TIEŽ  Technika rýchleho delenia

1. Populácia: údaje zahŕňajú všetkých členov, ktorí majú byť skúmaní.
Vzorec pre štandardnú odchýlku populácie používa deliteľ N (počet údajov).

2. Vzorka: údaje sú iba časťou populácie, zvyčajne sa používajú na reprezentáciu väčšej populácie.
Vzorec pre výpočet štandardnej odchýlky vzorky používa deliteľ (n − 1) na korekciu skreslenia odhadu. Táto korekcia sa nazýva Besselova korekcia.

V každodennej praxi (napr. výskum, prieskumy, analýza triedy) sa dáta často považujú za vzorku, takže deliteľ je (n − 1).

3. Vzorec pre štandardnú odchýlku

A. Vzorec pre štandardnú odchýlku populácie
Predpokladajme, že dáta: \( x_1, x_2, \dots, x_N \)
Priemerná populácia:
\[
\mu = \frac{\sum_{i=1}^{N} x_i}{N}
\]
Rozptyl populácie:
\[
σ² = (súčet i=1)^{N}(x_i – μ)²(N)
\]
Štandardná odchýlka populácie:
\[
σ = σ²
\]

B. Vzorový vzorec pre štandardnú odchýlku
Priemer vzorky:
\[
\bar{x} = \frac{\sum_{i=1}^{n} x_i}{n}
\]
Rozptyl vzorky:
\[
s^2 = \frac{\suma_{i=1}^{n}(x_i – \bar{x})^2}{n – 1}
\]
Štandardná odchýlka vzorky:
\[
s = \sqrt{s^2}
\]

4. Kroky na manuálny výpočet štandardnej odchýlky

Pre ľahšie pochopenie použijeme príklad údajov o skóre skúšok od 5 študentov:

Dáta: 60, 70, 70, 80, 90

Predpokladajme, že tieto údaje sú vzorkou (bežné v príkladoch učenia).

Krok 1: Vypočítajte priemer
\[
\bar{x} = \frac{60 + 70 + 70 + 80 + 90}{5} = \frac{370}{5} = 74
\]

Priemerné skóre je teda 74.

Krok 2: Vypočítajte rozdiel medzi jednotlivými údajmi a priemerom
Vytvorte stĺpec rozdielu \( (x_i – \bar{x}) \):

– 60 − 74 = −14
– 70 − 74 = −4
– 70 − 74 = −4
– 80 − 74 = 6
– 90 − 74 = 16

PREČÍTAJTE SI TIEŽ  Výpočet plochy trojuholníka

Krok 3: Umocnite rozdiel
Vypočítajte \( (x_i – \bar{x})^2 \):

– (−14)² = 196
– (−4)² = 16
– (−4)² = 16
– 6² = 36
– 16² = 256

Krok 4: Sčítajte štvorce rozdielov
\[
súčet (x_i – x)² = 196 + 16 + 16 + 36 + 256 = 520
\]

Krok 5: Výpočet rozptylu (pre vzorku vydelenie n − 1)
Keďže n = 5, potom n − 1 = 4:
\[
s^2 = \frac{520}{4} = 130
\]

Takže rozptyl vzorky je 130.

Krok 6: Druhá odmocnina rozptylu na získanie štandardnej odchýlky
\[
s = \sqrt{130} \approx 11{,}40
\]

Smerodajná odchýlka údajov je teda približne 11,40. To znamená, že skóre študentov sa v priemere odchyľuje od priemeru 74 približne o 11 bodov.

5. Rýchly spôsob: Alternatívny vzorec (výpočet)

Okrem vyššie uvedenej manuálnej metódy existuje výpočtový vzorec, ktorý sa často používa na zrýchlenie výpočtov, najmä ak je k dispozícii veľa údajov:

Rozptyl vzorky:
\[
s^2 = \frac{\súčet x_i^2 – \frac{(súčet x_i)^2}{n}}{n – 1}
\]

Tento vzorec sa vyhýba výpočtu rozdielov jeden po druhom, ale stále vyžaduje presnosť pri výpočte súčtu druhých mocnín údajov.

Pre koncepčné pochopenie je však postupná metóda (rozdiel → druhá mocnina → súčet) zvyčajne jednoduchšia a bezpečnejšia z hľadiska chýb.

6. Interpretácia štandardnej odchýlky

Štandardná odchýlka sa nekončí len pri číslach, ale musí sa interpretovať:

PREČÍTAJTE SI TIEŽ  Ako riešiť parciálne integrály

– Malá štandardná odchýlka: údaje sú zoskupené blízko priemeru, variácia je nízka, výsledky sú konzistentnejšie.
– Veľká štandardná odchýlka: údaje sú rozptýlené ďaleko od priemeru, variabilita je vysoká, výsledky sú menej konzistentné.

Napríklad predpokladajme, že dve triedy majú rovnaké priemerné skóre, 74. Ak má trieda A štandardnú odchýlku 5 a trieda B štandardnú odchýlku 15, potom sú skóre v triede A vyrovnanejšie a stabilnejšie. Trieda B má väčšiu variabilitu: niektoré sú veľmi nízke a niektoré veľmi vysoké.

7. Bežné chyby

Niektoré bežné chyby pri výpočte štandardnej odchýlky:

1. Zabudol som rozlišovať medzi vzorkou a populáciou, takže deliteľ je nesprávny (N vs n − 1).
2. Nesprávny výpočet priemeru, čo má za následok, že všetky nasledujúce kroky sú nesprávne.
3. Zabudnutie umocniť rozdiel alebo chyba pri odmocňovaní na konci.
4. Aritmetické chyby pri sčítaní alebo výpočte druhých mocnín čísel.

Chybám sa dá predísť vytvorením výpočtovej tabuľky a dvojitou kontrolou výsledkov.

Zatváranie

Výpočet štandardnej odchýlky nie je v skutočnosti zložitý, ak správne postupujete podľa krokov: vypočítajte priemer, nájdite rozdiel medzi jednotlivými súbormi údajov, umocnite rozdiely, sčítajte ich, vydeľte (n alebo n − 1) a potom odmocnite. Pochopením štandardnej odchýlky môžete posúdiť, ako konzistentné sú vaše údaje a aká je medzi nimi odchýlka.

Ak chcete, môžem vytvoriť aj ďalšie príklady s väčším počtom údajov, príklady zoskupených údajov (frekvenčné tabuľky) alebo príklady výpočtu štandardnej odchýlky pomocou Excelu/Google Tabuliek.

Zanechajte komentár

Táto stránka používa Akismet na redukciu spamu. Zistite, ako sa spracovávajú údaje z vašich komentárov