Inhaltsvalidität
In diesem Beitrag
Was versteht man unter Inhaltsvalidität?
Inhaltsvalidität ist ein Kriterium zur Beurteilung der Qualität eines Messinstruments – zum Beispiel eines Fragebogens, eines Tests oder einer Skala. Sie gibt an, ob die verwendeten Items (also Fragen oder Aufgaben) das zu messende Konstrukt vollständig und repräsentativ abdecken.
Ein Messinstrument gilt als inhaltsvalide, wenn es alle relevanten Facetten des interessierenden Merkmals erfasst – und zwar weder zu eng noch zu weit gefasst. Wird etwa Arbeitszufriedenheit gemessen, sollten alle wesentlichen Dimensionen berücksichtigt werden: Beziehung zu Vorgesetzten, Aufgabenvielfalt, Vergütung, Arbeitsklima und so weiter. Fehlen wichtige Bereiche, leidet die Inhaltsvalidität.
Anders als andere Validitätsformen lässt sich Inhaltsvalidität nicht mit einem einzelnen statistischen Kennwert berechnen. Sie wird primär durch Expertenurteile und systematische Analyse des Konstruktbereichs bewertet. Ein verbreitetes Hilfsmittel ist der von C. H. Lawshe entwickelte Content Validity Ratio (CVR):
Content Validity Ratio (CVR)
Dabei steht ne für die Anzahl der Experten, die ein Item als „wesentlich“ einstufen, und N für die Gesamtzahl der Experten. Der CVR nimmt Werte zwischen −1 und +1 an. Ein Wert von 0 bedeutet, dass genau die Hälfte der Experten das Item für wesentlich hält. Positive Werte zeigen einen wachsenden Konsens über die Relevanz eines Items.
Warum ist Inhaltsvalidität für statistische Analysen wichtig?
Inhaltsvalidität ist die Grundvoraussetzung dafür, dass ein Messinstrument überhaupt das misst, was es messen soll. Ohne sie sind alle weiteren statistischen Auswertungen – egal wie sorgfältig durchgeführt – von begrenztem Wert. Ein Fragebogen kann hohe interne Konsistenz und perfekte Reliabilität aufweisen und trotzdem das Konstrukt verfehlen, wenn relevante Inhaltsbereiche fehlen.
In der Praxis spielt Inhaltsvalidität besonders bei der Entwicklung neuer Messinstrumente eine zentrale Rolle: in der Psychologie, der Pädagogik, der Organisations- und Gesundheitsforschung. Wer beispielsweise für eine Dissertation einen eigenen Fragebogen entwickelt, sollte die Inhaltsvalidität systematisch sicherstellen – idealerweise durch eine Literaturanalyse des Konstrukts und die Einbeziehung von Fachexpertinnen und -experten.
Inhaltsvalidität ist dabei Teil eines größeren Validitätsgefüges. Sie wird häufig zusammen mit Konstruktvalidität und Kriteriumsvalidität betrachtet.
Praxisbeispiel zu Inhaltsvalidität
Eine Forscherin entwickelt einen Fragebogen zur Messung von Prokrastination bei Studierenden. Sie formuliert zunächst 20 Items und legt diese einem Panel aus fünf Expertinnen und Experten vor. Jede Person bewertet für jedes Item, ob es „wesentlich“, „nützlich, aber nicht wesentlich“ oder „nicht notwendig“ für das Konstrukt ist.
Für ein konkretes Item – etwa „Ich schiebe unangenehme Aufgaben auf, bis sie dringend werden“ – stufen vier der fünf Experten es als „wesentlich“ ein. Der CVR ergibt sich dann wie folgt:
CVR-Berechnung für das Beispiel-Item
Ein CVR von 0,60 gilt bei fünf Experten nach den Richtwerten von Lawshe als akzeptabel. Items mit einem CVR unter dem jeweiligen Schwellenwert werden überarbeitet oder aus dem Fragebogen entfernt.
| Item | Experten (wesentlich) | N gesamt | CVR | Bewertung |
|---|---|---|---|---|
| „Ich schiebe unangenehme Aufgaben auf …“ | 4 | 5 | 0,60 | Akzeptabel |
| „Ich plane meine Aufgaben langfristig …“ | 5 | 5 | 1,00 | Sehr gut |
| „Ich schlafe mindestens 7 Stunden …“ | 1 | 5 | −0,60 | Item entfernen |
Das letzte Item zum Schlafverhalten erzielt einen stark negativen CVR – die Experten sind sich einig, dass es für das Konstrukt Prokrastination nicht wesentlich ist. Es wird aus dem Fragebogen gestrichen. So entsteht Schritt für Schritt ein Instrument mit hoher Inhaltsvalidität.