Kriteriumsvalidität
In diesem Beitrag
Was versteht man unter Kriteriumsvalidität?
Kriteriumsvalidität ist ein Gütekriterium psychologischer und sozialwissenschaftlicher Messverfahren. Sie gibt an, wie gut ein Test oder ein Messinstrument ein externes Außenkriterium vorhersagt oder mit ihm übereinstimmt. Das Außenkriterium ist dabei eine unabhängige Referenzgröße, die das interessierende Merkmal auf andere Weise abbildet – zum Beispiel eine Experteneinschätzung, ein Diagnoseergebnis oder ein späteres Verhalten.
Quantitativ wird Kriteriumsvalidität üblicherweise durch den Validitätskoeffizienten ausgedrückt – das ist der Korrelationskoeffizient zwischen den Testwerten und den Kriteriumswerten. Je höher diese Korrelation, desto besser sagt der Test das Kriterium vorher.
Man unterscheidet zwei Formen der Kriteriumsvalidität:
- Übereinstimmungsvalidität (concurrent validity): Test und Kriterium werden zum gleichen Zeitpunkt erhoben. Beispiel: Ein neuer Angstfragebogen wird gleichzeitig mit einem etablierten Angstinventar verglichen.
- Vorhersagevalidität (predictive validity): Das Kriterium wird erst zu einem späteren Zeitpunkt gemessen. Beispiel: Ein Eignungstest sagt den späteren Berufserfolg vorher.
Warum ist Kriteriumsvalidität für statistische Analysen wichtig?
In empirischen Studien – ob in der Psychologie, Medizin, Pädagogik oder den Wirtschaftswissenschaften – werden häufig Fragebogen, Skalen oder Tests eingesetzt, um latente Konstrukte zu messen. Ob ein solches Instrument tatsächlich das misst, wofür es konzipiert wurde, ist keine Selbstverständlichkeit. Die Kriteriumsvalidität liefert dafür einen konkreten, statistisch überprüfbaren Beleg.
Für deine Arbeit ist das besonders dann relevant, wenn du ein eigenes Messinstrument entwickelst, ein bestehendes in einem neuen Kontext einsetzt oder die Güte eines Tests begründen musst. Ohne ausreichende Kriteriumsvalidität sind Schlussfolgerungen aus Testergebnissen methodisch angreifbar.
Typische Fehler und Missverständnisse im Umgang mit Kriteriumsvalidität:
- Falsches Kriterium: Das gewählte Außenkriterium bildet das Konstrukt selbst nur unzureichend ab. Ein Test zur Messung von „Stressempfinden“ am Kriterium „Herzrate“ zu validieren ist möglich, aber allein nicht ausreichend, da Herzrate viele andere Einflüsse hat.
- Criterion contamination: Das Kriterium ist durch die Testwerte beeinflusst, etwa wenn Beurteiler die Testergebnisse kennen, bevor sie das Kriterium einschätzen. Das verzerrt den Validitätskoeffizienten nach oben.
- Überschätzung durch Range-Restriction: Wenn nur ein eingeschränkter Bereich der Stichprobe untersucht wird (z. B. nur Studierende), kann die gemessene Korrelation künstlich niedrig ausfallen.
Praxisbeispiel zu Kriteriumsvalidität
Stell dir vor, du entwickelst im Rahmen deiner Masterarbeit einen neuen Fragebogen zur Messung von Prokrastination (Aufschiebeverhalten). Du möchtest zeigen, dass dein Instrument tatsächlich Prokrastination misst – und nicht bloß allgemeine Trägheit oder Erschöpfung.
Zur Überprüfung der Kriteriumsvalidität erhebst du bei denselben Studierenden zusätzlich die Anzahl der nicht fristgerecht abgegebenen Hausarbeiten im letzten Semester – ein externes, objektives Kriterium für Prokrastination im Studium.
| Person | Fragebogen-Score (0–100) | Versäumte Abgaben (Kriterium) |
|---|---|---|
| A | 85 | 4 |
| B | 72 | 3 |
| C | 45 | 1 |
| D | 30 | 0 |
| E | 60 | 2 |
Die Korrelation zwischen Fragebogen-Score und der Anzahl versäumter Abgaben berechnet sich als Pearson-Korrelationskoeffizient. Ein Ergebnis von beispielsweise r = .82 würde auf eine hohe Kriteriumsvalidität hinweisen: Wer im Fragebogen viel Prokrastination angibt, hat tatsächlich häufiger Abgaben verpasst. Dieses Ergebnis stützt die Behauptung, dass dein Instrument valide ist.