Itemvarianz
In diesem Beitrag
Was versteht man unter Itemvarianz?
Die Itemvarianz beschreibt, wie stark die Antworten der Befragten auf ein einzelnes Item – also eine einzelne Frage oder Aufgabe in einem Test oder Fragebogen – voneinander abweichen. Sie ist ein Maß für die Streuung der Antwortverteilung eines Items und wird berechnet als die Varianz der Rohwerte dieses Items über alle Befragten hinweg.
Formal gilt für die Varianz eines Items i:
Formel: Itemvarianz
Dabei steht xij für den Wert von Person j auf Item i, x̄i für den Mittelwert des Items und n für die Anzahl der Personen.
Die Itemvarianz ist eng mit dem Schwierigkeitsindex eines Items verknüpft: Bei dichotomen Items (z. B. richtig/falsch) ist die Varianz am größten, wenn genau die Hälfte der Personen das Item korrekt beantwortet (p = 0,5), und sinkt gegen null, je eher alle Personen gleich antworten.
Warum ist Itemvarianz für statistische Analysen wichtig?
Die Itemvarianz spielt in der klassischen Testtheorie (KTT) und bei der Entwicklung von Fragebögen eine zentrale Rolle. Sie beeinflusst direkt mehrere wichtige Kennwerte:
- Reliabilität: Die Gesamtvarianz eines Tests setzt sich aus den Itemvarianzen und den Kovarianzen zwischen den Items zusammen. Items mit sehr niedriger Varianz tragen kaum zur Differenzierung zwischen Personen bei und verschlechtern damit potenziell die Messgenauigkeit.
- Trennschärfe: Die Trennschärfe – also die Korrelation eines Items mit dem Gesamtscore – kann nur dann hoch ausfallen, wenn das Item überhaupt ausreichend streut. Ohne Varianz keine Korrelation.
- Testkonstruktion: Bei der Auswahl von Items für einen finalen Test werden Items mit zu niedriger Varianz oft ausgeschlossen, weil sie keine sinnvolle Unterscheidung zwischen Personen ermöglichen.
Praxisbeispiel zu Itemvarianz
Eine Forscherin entwickelt einen Fragebogen zur Messung von Prüfungsangst. Darin enthalten ist unter anderem das Item: „Ich mache mir vor Prüfungen Sorgen.“ – beantwortet auf einer Skala von 1 (stimme gar nicht zu) bis 5 (stimme voll zu).
Nach einer Pilotbefragung mit 120 Studierenden wertet sie die Antwortverteilungen aus:
| Item | Mittelwert | Itemvarianz | Bewertung |
|---|---|---|---|
| „Ich mache mir Sorgen.“ | 3,4 | 1,82 | Gut – hohe Streuung, differenziert gut |
| „Ich habe schon einmal eine Prüfung geschrieben.“ | 4,9 | 0,09 | Problematisch – fast alle stimmen zu |
Das zweite Item hat eine extrem niedrige Varianz, weil nahezu alle Befragten zustimmen. Es unterscheidet die Studierenden kaum voneinander und ist für die Messung von Prüfungsangst praktisch nutzlos. Die Forscherin entscheidet sich, dieses Item aus dem finalen Fragebogen zu entfernen. Das erste Item hingegen streut gut und trägt sinnvoll zur Skala bei.