Fórmula da distribución normal en estatística

# Fórmula da distribución normal en estatística

A distribución normal, tamén coñecida como distribución gaussiana ou curva de campá, é un dos conceptos máis fundamentais da estatística. A súa existencia adoita considerarse a base de diversas análises estatísticas e de probabilidade. Esta distribución non só se emprega con frecuencia na teoría, senón tamén en diversas aplicacións prácticas, como a xestión de riscos financeiros, as ciencias sociais, a medicina e outras.

## Definición de distribución normal

A distribución normal é unha distribución de probabilidade continua que é simétrica respecto á súa media. Noutras palabras, unha representación gráfica desta distribución formará unha curva de campá que se ensancha na media e se estreita nas colas. Esta distribución ten dous parámetros principais: a media (μ) e a desviación estándar (σ).

A media determina a localización do centro da distribución, mentres que a desviación estándar mide o dispersos que están os datos arredor da media. Canto maior sexa a desviación estándar, máis ancha e curta será a curva de distribución; canto menor sexa a desviación estándar, máis estreita e inclinada será a curva.

## Función de densidade de probabilidade

A función de densidade de probabilidade (pdf) para a distribución normal ten a seguinte forma matemática:

\[ f(x | μ, σ) = \frac{1}{\sigma \sqrt{2 π}} e^{ -\frac{(x - μ)^2}{2\sigma^2} } \]

Aquí:
– \(x \) é unha variable aleatoria.
– \( \mu \) é a media da distribución.
– \( \sigma \) é a desviación estándar da distribución.
– \(e \) é a base do logaritmo natural, aproximadamente 2.71828.

A función anterior crea unha curva campaniforme simétrica. A integral desta función entre dous puntos dá a probabilidade de que a variable aleatoria se atope entre eses dous valores.

## Distribución normal estándar

A distribución normal estándar é unha distribución normal con media μ = 0 e desviación estándar σ = 1. A función de densidade de probabilidade para a distribución normal estándar é:

\[ f(z) = \frac{1}{\sqrt{2 \pi}} e^{ -\frac{z^2}{2} } \]

Aquí:
– \(z\) é unha variable aleatoria que segue unha distribución normal estándar.

A distribución normal estándar úsase a miúdo porque nos permite estandarizar outras distribucións normais mediante un proceso chamado "estandarización". A estandarización implica transformar os valores \(x\) da distribución normal \(N(\mu, \sigma)\) aos valores \(z\) da distribución normal estándar \(N(0, 1)\), usando a seguinte fórmula:

\[ z = \frac{x – \mu}{\sigma} \]

Este proceso facilita a comparación de valores de diferentes distribucións normais mapeándoos a unha única escala.

## Aplicación e relevancia

### 1. Teorema do límite central

A distribución normal é particularmente relevante no contexto do Teorema do Límite Central (TCC). O TCC afirma que un número suficientemente grande de variables aleatorias independentes terán unha distribución aproximadamente normal, independentemente da forma da distribución orixinal. Isto significa que a distribución normal pódese usar para aproximar a distribución da media da mostra, sempre que a mostra sexa o suficientemente grande.

### 2. Inferencia estatística

A distribución normal permite a aplicación de probas de hipóteses, como a proba z e a proba t. Ambos os métodos empregan a distribución normal estándar para determinar a significación estatística dos resultados observados. A proba z úsase normalmente cando o tamaño da mostra é grande ou se coñece a desviación estándar da poboación, mentres que a proba t aplícase cando o tamaño da mostra é pequeno ou se descoñece a desviación estándar da poboación.

### 3. Análise de regresión

Na análise de regresión lineal, a suposición de que os datos de erro teñen unha distribución normal é crucial. Esta suposición permite o cálculo de intervalos de confianza e as probas de significancia dos parámetros do modelo de regresión. Do mesmo xeito, a detección de erros de datos ou valores atípicos adoita facerse examinando a distribución residual para detectar desviacións significativas da normalidade.

### 4. Medicina e Bioloxía

En medicina, a distribución normal úsase para describir a distribución de diversos fenómenos biolóxicos. Por exemplo, a altura, a presión arterial e certos resultados de probas de laboratorio adoitan seguir unha distribución normal. Isto facilita a determinación de valores de corte para diagnósticos médicos.

### 5. Finanzas e economía

En finanzas, a distribución normal utilízase para modelar moitos fenómenos, como a rendibilidade das accións, os tipos de xuro e outros. Aínda que na práctica, as accións adoitan presentar unha maior asimetría e curtose, a suposición dunha distribución normal aínda proporciona unha base analítica sólida.

## Implementación e cálculo

### Usando Python

Python, con bibliotecas como NumPy e SciPy, proporciona varios métodos para traballar coa distribución normal. Aquí tes un exemplo de como podemos xeneralizar e representar graficamente a distribución normal usando estas bibliotecas:

"pitón"
importar numpy como np
importar matplotlib.pyplot como plt
da norma de importación de scipy.stats

# Parámetros de distribución normal
mu = 0 # media
sigma = 1 # desviación estándar

# Datos para a distribución normal
x = np.linspace(-5, 5, 1000)
y = norma.pdf(x, mu, sigma)

# Gráfica de distribución normal
plt.plot(x, y)
plt.xlabel('x')
plt.ylabel('Densidade')
plt.title('Distribución normal N(0, 1)')
plt.show()
“

No exemplo anterior, xeramos datos de distribución normal con media 0 e desviación estándar 1 e, a seguir, representamos graficamente a súa función de densidade de probabilidade.

## Conclusión

A distribución normal xoga un papel crucial na estatística e na probabilidade. O seu uso universal, dende o Teorema do Límite Central ata diversas aplicacións prácticas como a análise de regresión e as probas de hipóteses, convértea nunha das distribucións de probabilidade máis populares e importantes. Comprender a fórmula da distribución normal e como usala de forma eficaz é unha habilidade esencial para calquera persoa que traballe na ciencia de datos, a investigación, a economía e moitos outros campos.

Con este coñecemento, podemos abordar e resolver varios tipos de problemas analíticos de forma máis eficaz, o que nos permite tomar mellores decisións baseadas nos datos e probabilidades dispoñibles.

Deixar un comentario