Mann-Whitney-Test in der Statistik
Statistik ist ein Teilgebiet der Mathematik, das sich mit der Erhebung, Analyse, Interpretation und Darstellung von Daten befasst. Sie wird in verschiedenen Bereichen eingesetzt, um datengestützte Entscheidungen zu treffen. Eine häufig verwendete statistische Methode ist der Mann-Whitney-U-Test (auch bekannt als Wilcoxon-Rangsummentest). Dieses nichtparametrische Verfahren dient dazu, festzustellen, ob ein signifikanter Unterschied zwischen zwei unabhängigen Gruppen besteht.
Einführung in den Mann-Whitney-Test
Der Mann-Whitney-Test wurde 1947 von Henry Mann und Donald Whitney als nichtparametrische Alternative zum t-Test eingeführt. Diese Methode setzt keine Normalverteilung voraus. Daher ist sie besonders nützlich, wenn die Daten keiner Normalverteilung folgen oder der Stichprobenumfang zu klein ist, um die Normalverteilungsannahme zu überprüfen.
Grundprinzipien des Mann-Whitney-Tests
Der Mann-Whitney-Test dient dem Vergleich der Mediane zweier Gruppen. Das Grundprinzip lautet:
1. Rangfolge der Beobachtungen: Alle Daten beider Gruppen werden zusammengeführt und vom kleinsten zum größten Wert geordnet. Bei identischen Werten wird jeder Beobachtung der Durchschnitt seines jeweiligen Rangs zugeordnet.
2. Berechnung des statistischen Tests: Der statistische Testwert (U) wird anhand der Rangsumme jeder Gruppe berechnet. Es gibt zwei Berechnungsmethoden: eine beginnt mit der ersten Gruppe, die andere mit der zweiten.
Die allgemeine Formel für U lautet:
\[
U_1 = n_1 \times n_2 + \frac{n_1 \times (n_1 + 1)}{2} – R_1
\]
atau
\[
U_2 = n_1 \times n_2 + \frac{n_2 \times (n_2 + 1)}{2} – R_2
\]
Wo:
– \(n_1\) und \(n_2\) sind die Anzahl der Beobachtungen in den jeweiligen Gruppen,
– \(R_1\) und \(R_2\) sind die Anzahl der Ränge in jeder Gruppe.
3. Signifikanztest: Der Signifikanztest dient der Bestimmung des p-Werts. Bei großen Stichprobenumfängen kann die U-Verteilung durch eine Normalverteilung angenähert werden.
Annahmen beim Mann-Whitney-Test
Obwohl der Mann-Whitney-Test ein nichtparametrischer Test ist und keine Normalverteilung voraussetzt, müssen für die Gültigkeit der Ergebnisse mehrere damit verbundene Annahmen erfüllt sein:
1. Unabhängigkeit: Jede Beobachtung in beiden Gruppen muss unabhängig von der anderen sein.
2. Ordinalskala oder Intervallskala: Die Daten müssen auf einer Ordinalskala oder Intervallskala vorliegen. Das bedeutet, dass die Daten sortiert werden können und Ranginformationen enthalten.
3. Verteilungsbereich: Die Verteilung beider Gruppen muss die gleiche Form aufweisen (auch wenn der Median unterschiedlich sein kann).
Schritte zur Durchführung des Mann-Whitney-Tests
Im Folgenden werden die üblicherweise befolgten Schritte zur Durchführung des Mann-Whitney-Tests beschrieben:
1. Daten zusammenführen und sortieren: Die Daten beider Gruppen werden zusammengeführt und anschließend sortiert. Die Rangfolge wird anhand der Reihenfolge und unter Berücksichtigung des Mittelwerts angepasst.
2. Anzahl der Ranglisten berechnen: Ermitteln Sie die Anzahl der Ranglistenplätze für jede Gruppe.
3. Ermittlung des U-Wertes in der Statistik: Verwenden Sie die zuvor erläuterte Formel, um den U-Wert für beide Gruppen zu berechnen.
4. Ermittlung des kritischen Wertes oder p-Wertes: Vergleichen Sie den erhaltenen U-Wert mit dem kritischen Wert aus der U-Verteilungstabelle (oder berechnen Sie den p-Wert), um festzustellen, ob der Unterschied zwischen den Gruppen statistisch signifikant ist.
Nehmen wir beispielsweise an, wir haben zwei Datensätze A und B. Diese Daten könnten zwei verschiedene Therapien für eine bestimmte Krankheit darstellen, und wir möchten wissen, ob eine Therapie wirksamer ist als die andere.
Praxisbeispiel
Nehmen wir an, wir haben zwei Therapiegruppen:
– Therapie A: [85, 90, 88, 75, 91]
– Therapie B: [80, 78, 95, 87, 92]
1. Zusammenführen und Sortieren von Daten:
– Gesamt: [85, 90, 88, 75, 91, 80, 78, 95, 87, 92]
– Reihenfolge und Rang: [75(1), 78(2), 80(3), 85(4), 87(5), 88(6), 90(7), 91(8), 92(9), 95(10)]
2. Berechnung der Ranganzahl:
– Anzahl der Therapie-A-Bewertungen: 4 + 7 + 6 + 1 + 8 = 26
– Anzahl der Therapie-B-Bewertungen: 3 + 2 + 10 + 5 + 9 = 29
3. Berechnung des U-Wertes:
\[
U_A = n_1 \times n_2 + \frac{n_1 \times (n_1 + 1)}{2} – R_A = 5 \times 5 + \frac{5 \times (5 + 1)}{2} – 26 = 25 + 15 – 26 = 14
\]
\[
U_B = n_1 \times n_2 + \frac{n_2 \times (n_2 + 1)}{2} – R_B = 5 \times 5 + \frac{5 \times (5 + 1)}{2} – 29 = 25 + 15 – 29 = 11
\]
Wählen Sie einen kleineren U-Wert, nämlich U = 11.
4. Bestimmung der Signifikanz:
Vergleichen Sie den ermittelten U-Wert mit dem kritischen U-Wert aus der Mann-Whitney-Verteilungstabelle oder berechnen Sie den p-Wert. Ist U kleiner als der kritische Wert oder der p-Wert kleiner als das Signifikanzniveau α (z. B. 0,05), verwerfen wir die Nullhypothese und schließen daraus, dass ein signifikanter Unterschied zwischen den beiden Gruppen besteht.
Vorteile und Grenzen des Mann-Whitney-Tests
Vorteile:
1. Nichtparametrisch: Erfordert keine Annahme einer Normalverteilung.
2. Flexibilität: Kann verwendet werden, wenn die Daten auf einer Ordinalskala vorliegen oder Ausreißer enthalten.
3. Einfach und effektiv: Leicht zu berechnen und zu interpretieren.
Weitere Informationen:
1. Effizienzverlust: Bei einer Normalverteilung ist der t-Test effizienter.
2. Annahme der gleichen Verteilungsform: Dieser Test setzt voraus, dass die Verteilungsform in beiden Gruppen gleich ist.
3. Einschränkung bei kleinen Stichprobenumfängen: Die asymptotische Verteilung ist bei sehr kleinen Stichproben möglicherweise weniger genau.
Abschluss
Der Mann-Whitney-Test ist ein leistungsstarkes und flexibles nichtparametrisches Verfahren zur Identifizierung von Unterschieden zwischen zwei unabhängigen Gruppen. Durch das Verständnis seiner grundlegenden Prinzipien und Anwendungsschritte lässt sich dieser Test in vielfältigen Forschungsbereichen einsetzen. Obwohl er einige Einschränkungen aufweist, machen ihn seine Vorteile unter bestimmten Umständen zu einer sehr wertvollen Methode in der Statistik.