Interne Konsistenz
In diesem Beitrag
Was versteht man unter Interner Konsistenz?
Interne Konsistenz ist ein Maß für die Reliabilität eines Messinstruments – zum Beispiel eines Fragebogens oder einer Skala. Sie gibt an, wie stark die einzelnen Items (Fragen oder Aussagen) eines Tests dasselbe zugrundeliegende Konstrukt messen. Sind alle Items einer Skala hoch miteinander korreliert, misst das Instrument konsistent: Die Antworten auf verschiedene Fragen hängen systematisch zusammen und spiegeln denselben Sachverhalt wider.
Der am häufigsten verwendete Kennwert für interne Konsistenz ist Cronbachs Alpha (α). Er berechnet sich vereinfacht als gewichtetes Verhältnis der mittleren Inter-Item-Kovarianz zur Gesamtvarianz der Skala:
Cronbachs Alpha
Dabei steht k für die Anzahl der Items, für die Summe der Item-Varianzen und für die Varianz des Gesamtscores. Der Wertebereich von Alpha liegt theoretisch zwischen 0 und 1 – je näher an 1, desto konsistenter misst die Skala.
Warum ist Interne Konsistenz für statistische Analysen wichtig?
In der empirischen Forschung werden Konstrukte wie Intelligenz, Motivation oder Zufriedenheit häufig nicht direkt beobachtet, sondern über mehrere Items indirekt erfasst. Damit die Ergebnisse solcher Messungen interpretierbar und vertrauenswürdig sind, muss das Instrument zunächst reliabel sein – und interne Konsistenz ist dabei eine der zentralen Reliabilitätsprüfungen.
Als Faustregel gelten folgende Richtwerte für Cronbachs Alpha:
| Alpha-Wert | Bewertung |
|---|---|
| ≥ .90 | Exzellent |
| .80 – .89 | Gut |
| .70 – .79 | Akzeptabel |
| .60 – .69 | Fraglich |
| < .60 | Unzureichend |
In der Praxis wird für Forschungszwecke ein Wert von α ≥ .70 als Mindestanforderung angesehen. Für klinische oder diagnostische Entscheidungen – wo viel auf dem Spiel steht – sollte Alpha deutlich höher liegen (≥ .90).
Praxisbeispiel zu Interner Konsistenz
Eine Psychologiestudentin entwickelt im Rahmen ihrer Masterarbeit einen Fragebogen zur Messung von akademischer Selbstwirksamkeit. Der Fragebogen enthält zehn Items auf einer fünfstufigen Likert-Skala, zum Beispiel:
- „Ich bin zuversichtlich, schwierige Prüfungen zu bestehen.“
- „Ich glaube, dass ich komplexe Lernaufgaben meistern kann.“
- „Auch bei Rückschlägen bleibe ich motiviert.“
Nach der Datenerhebung mit 120 Studierenden berechnet sie in SPSS oder R die Reliabilitätsanalyse und erhält ein Cronbachs Alpha von α = .83. Das liegt im guten Bereich. Zusätzlich prüft sie die korrigierte Item-Skala-Korrelation für jedes einzelne Item: Ein Item, das nur eine Korrelation von .12 mit dem Gesamtscore aufweist, fällt inhaltlich aus dem Rahmen und wird nach inhaltlicher Prüfung aus dem Fragebogen entfernt. Nach dieser Bereinigung steigt Alpha leicht auf .86 – das Instrument misst nun kohärenter.
Dieses Vorgehen – Berechnung von Alpha, Prüfung der Item-Kennwerte und gegebenenfalls Überarbeitung der Skala – ist ein Standardschritt in der Fragebogenentwicklung und sollte in jeder Arbeit, die eigene Skalen verwendet, transparent berichtet werden.