P-Wert Statistik
Als eine wesentliche Grösse bei Hypothesentests ist der p-Wert Statistik-Interessierten ein wichtiger Begriff. Er misst die Wahrscheinlichkeit, dass ein in der Stichprobe beobachteter Unterschied zwischen zwei Gruppen zufällig entstanden sein könnte (die Nullhypothese stimmt). Ist diese Wahrscheinlichkeit gering, dann ist der beobachtete Unterschied vermutlich statistisch signifikant und eventuell auch auf die Grundgesamtheit übertragbar.
Sollten Sie statistische Beratung oder Unterstützung bei der Erhebung oder Analyse von Daten benötigen, helfen unsere Statistiker Ihnen gerne weiter.
Hypothesentests
Eine häufige Aufgabe in der Statistik besteht darin, anhand von Stichprobendaten zu bewerten, ob eine Hypothese wahr ist oder falsch. Nehmen wir beispielsweise die Hypothese H1 „Männer sind grösser als Frauen“. Da es unmöglich ist, alle Männer und alle Frauen zu vermessen, wird man stattdessen bei einer Stichprobe von einigen Männern und einigen Frauen die Körpergrösse messen. Selbst wenn wir bei unseren Messungen festgestellt haben, dass Männer im Durchschnitt grösser sind als der Durchschnitt der Frauen, so gilt dies zunächst nur für unsere Stichprobe. Gilt dies aber auch für die Gesamtbevölkerung? Es könnte sein, dass der von uns gemessene Unterschied zufällig zustande gekommen ist. Mit Hilfe statistischer Methoden berechnet man nun, wie hoch die Wahrscheinlichkeit ist, dass der gemessene Unterschied nicht zufällig entstand.
Sie haben Schwierigkeiten den p-Wert zu berechnen oder zu interpretieren? Oder benötigen Sie Unterstützung bei anderen Aspekten für Ihre statistische Auswertung? Dann helfen Ihnen unsere Experten bei einer individuellen Statistik Beratung gerne weiter! Nutzen Sie einfach unser Kontaktformular für eine kostenlose Beratung & ein unverbindliches Angebot – oder rufen Sie uns an.
Die p-Wert Statistik: Statistik und die Nullhypothese
Es ist immer leichter, eine Hypothese zu verwerfen, als sie zu beweisen. Darum geht man beim Hypothesentest so vor, dass man eine Nullhypothese H0 formuliert, die das Gegenteil von dem besagt, was man belegen will. Die Nullhypothese H0 besagt also das Gegenteil von Hypothese H1. Lautet H1 „Männer sind grösser als Frauen“, dann lautet H0 „Männer sind kleiner oder gleich gross wie Frauen“. Lautet H1 jedoch „Männer haben eine andere Körpergrösse als Frauen“, wäre H0 „Männer und Frauen sind gleich gross“.
Nun kann es sein, dass die Nullhypothese stimmt oder nicht. Je nachdem, ob die Hypothese als wahr oder falsch annimmt, kann man jeweils einen Fehler machen. Es gibt insgesamt vier Möglichkeiten:
| Die Nullhypothese stimmt. | Die Nullhypothese H0 stimmt nicht, also ist H1 wahr. | |
| Hypothese H0 wird als wahr angenommen. | Hypothese H0 wird zu Recht als wahr angenommen. (1- α) | Fehler 2. Art (β) |
| Hypothese H0 wird als falsch angenommen. | Fehler 1. Art (α) | Hypothese H0 wird zu Recht als falsch angenommen. (1-β) |
Die Wahrscheinlichkeit eines Fehlers 1. Art nennt man per Definition α und die Wahrscheinlichkeit eines Fehlers 2. Art β. Die Wahrscheinlichkeit (1-β) wird als statistical power bezeichnet, also die Fähigkeit, die Hypothese H0 zu Recht als falsch zu erkennen. Die Fehlerwahrscheinlichkeiten α und β hängen voneinander ab: Je kleiner man α wählt, also je mehr man vermeiden will, die Hypothese fälschlicherweise abzulehnen, umso grösser wird β, also die Wahrscheinlichkeit, die Hypothese fälschlicherweise als wahr anzunehmen. Üblicherweise legt man α zu Beginn einer Untersuchung fest und damit indirekt auch β.
Der p-Wert: Die Wahrscheinlichkeit der Daten, wenn die Nullhypothese stimmt
Zumeist wird man in der Stichprobe einen Unterschied zwischen Männern und Frauen finden. Nun stellt sich die Frage, wie gross die Wahrscheinlichkeit ist, dass der beobachtete Unterschied auftritt, obwohl die Nullhypothese H0 gilt. In unserem Fall: Wie hoch ist die Wahrscheinlichkeit, dass in unserer Stichprobe die Männer durchschnittlich grösser sind als die Frauen, obwohl es sich in der Gesamtbevölkerung genau umgekehrt verhält? In dieser Konstellation spielt der p-Wert Statistiken bei der Messung der Wahrscheinlichkeiten zu, d.h. dass bei gültiger Nullhypothese H0 trotzdem der gefundene Unterschied gemessen wird oder sogar ein grösserer Unterschied. Je kleiner der p-Wert ist, umso unwahrscheinlicher ist es, dass die Nullhypothese H0 stimmt, und umso wahrscheinlicher wird es, dass die Hypothese H1 wahr ist, also der beobachtete Unterschied tatsächlich etwas zu bedeuten hat und die tatsächlichen Grössenverhältnisse in der Gesamtbevölkerung widerspiegelt.
Durch Berechnung des p-Wertes versucht man also testweise, den beobachteten Unterschied durch einen rein zufälligen Effekt zu erklären. Gelingt das nicht, ist der p-Wert also klein genug, dann gilt wohl die Hypothese H1. „Klein genug“ bedeutet, dass p ≤ α ist. Der p-Wert wird auch „empirisches Signifikanzniveau“ genannt, weil er misst, ob der beobachtete Unterschied zwischen zwei Gruppen statistisch signifikant, also bedeutsam ist.
Umgekehrt kann man jedoch aus der Tatsache, dass der p Wert gross ist, nicht schliessen, dass die Nullhypothese H0 richtig ist, also beispielsweise die beiden Gruppen gleich sind. Man muss daraus eher schlussfolgern, dass nicht genügend Informationen vorliegen, um über die Hypothese zu entscheiden. Entweder ist der Effekt zu gering, um nachgewiesen zu werden, oder die Stichprobe ist zu klein.
Die Berechnung der p-Wert Statistik
Um den p-Wert zu berechnen, muss man ausser den Daten der Stichprobe auch noch einige Informationen über die Gesamtbevölkerung kennen. Diese Informationen hat man natürlich nicht, weil man ja eben nicht die Gesamtbevölkerung vermessen hat, sondern nur eine Stichprobe. Man kann die Kennzahlen der tatsächlichen Grössenverteilung also nur schätzen bzw. Annahmen darüber treffen.
Die Berechnung des p-Wertes wird jedoch dadurch vereinfacht, wenn wir laut Nullhypothese annehmen, dass sich die Körpergrössen von Männern und Frauen gleich verteilen, also Mittelwert und Standardabweichung dieser Verteilungen gleich sind.
Betrachtet man den Mittelwert einer gaussverteilten Variablen, wie z.B. die Körpergrösse, verwendet man die t-Verteilung (auch Student-Verteilung genannt) zur Berechnung des p-Wertes. Bei zufälligen Ereignissen wie dem Defekt eines Gerätes wird für die Berechnung des p-Wertes die Binomialverteilung verwendet. Für diskrete Variablen, z.B. solche die durch Zählung ermittelt werden wie die Anzahl an Ereignissen innerhalb einer Gruppe, wird die Chi-Quadrat-Verteilung verwendet.
Faustregeln für den p-Wert
Für die Bestätigung der Hypothese H1 ist es gut, wenn der p-Wert möglichst gering ist. Üblicherweise wird ein p-Wert von maximal 5% oder 1% angestrebt. Das heisst, der Unterschied zwischen zwei Gruppen wäre dann mit 1-p = 95% oder mit 99% Wahrscheinlichkeit statistisch signifikant. Der p-Wert hängt vor allem von zwei Faktoren ab, nämlich der Standardabweichung der Verteilung und der Grösse der Stichprobe. Beides lässt sich anschaulich gut vorstellen.
Nimmt man beispielsweise die kleinstmögliche Stichprobengrösse 1+1, misst also die Körpergrössen von nur einem Mann und einer Frau, dann kann es sehr leicht passieren, dass der Mann kleiner ist als die Frau. Je mehr Personen man jedoch berücksichtigt, umso unwahrscheinlicher wird es, dass die Stichprobe nur kleine Männer und grosse Frauen enthält. Nähert sich die Grösse der Stichprobe sogar der Grösse der Gesamtpopulation, dann wird man ohnehin alle Menschen vermessen und vermeidet den Einfluss des Zufalls.
Haben wir eine Gesamtbevölkerung, in der alle Frauen exakt gleich gross sind und ebenfalls alle Männer gleich gross, dann wird ein gemessener Unterschied auch statistisch signifikant sein. Gibt es aber ein breites Spektrum an Körpergrössen sowohl bei den Frauen als auch bei den Männern, dann wird es immer wahrscheinlicher, dass durch eine ungünstige Auswahl der Stichprobe die Frauengruppe im Schnitt grösser ist als die Männergruppe und damit wird p gross.

Häufig gestellte Fragen
Was ist ein P-Wert in der Statistik?
Ein P-Wert ist ein statistisches Mass dafür, wie wahrscheinlich es ist, dass ein beobachteter Unterschied zwischen Gruppen zufällig auftritt. Es gibt an, wie stark die Evidenz gegen die Nullhypothese ist, dass es keinen Unterschied zwischen den Gruppen gibt. Ein kleiner P-Wert (z. B. <0,05) deutet darauf hin, dass die Wahrscheinlichkeit, dass der Unterschied zufällig auftritt, sehr gering ist.
Wie wird der P-Wert berechnet?
Der P-Wert wird berechnet, indem die Wahrscheinlichkeit bestimmt wird, den beobachteten oder einen noch stärkeren Unterschied zwischen den Gruppen zu erhalten, wenn die Nullhypothese wahr ist. Dies wird durch die Verwendung statistischer Tests wie des t-Tests oder der ANOVA erreicht, die den P-Wert berechnen, basierend auf der Verteilung der Stichproben und der Stärke des Unterschieds.
Was bedeutet ein P-Wert von 0,05?
Ein P-Wert von 0,05 bedeutet, dass die Wahrscheinlichkeit, einen Unterschied zwischen Gruppen zu beobachten, der so gross oder grösser ist als der beobachtete Unterschied, wenn die Nullhypothese wahr ist, 5% beträgt. Mit anderen Worten, es besteht eine 5%ige Wahrscheinlichkeit, dass der Unterschied zufällig auftritt.
Was ist der Zusammenhang zwischen dem P-Wert und dem Signifikanzniveau?
Das Signifikanzniveau ist der Schwellenwert, der festlegt, ob ein Unterschied zwischen Gruppen als signifikant angesehen wird oder nicht. In der Regel wird ein Signifikanzniveau von 0,05 verwendet, was bedeutet, dass ein P-Wert kleiner als 0,05 als signifikant angesehen wird. Wenn der P-Wert grösser als das Signifikanzniveau ist, wird die Nullhypothese nicht abgelehnt.
Ist ein kleiner P-Wert immer aussagekräftiger als ein grosser P-Wert?
Ein kleiner P-Wert deutet darauf hin, dass der Unterschied zwischen Gruppen wahrscheinlich nicht zufällig ist. Ein grosser P-Wert bedeutet jedoch nicht zwangsläufig, dass die Nullhypothese wahr ist. Es ist wichtig, den Kontext zu berücksichtigen und auch andere Faktoren wie die Grösse der Stichprobe, die Stärke des Effekts und die Methodik der Studie zu berücksichtigen.
Ein anschauliches Video über den p-Wert und Hypothesentests
Ein kritischer Artikel über die Überinterpretation des p-Wertes
P-Werte korrekt einordnen und durch aussagekräftige Masse ergänzen.
