Ridge-Regression
In diesem Beitrag
Was versteht man unter Ridge-Regression?
Die Ridge-Regression ist eine Erweiterung der klassischen linearen Regression, die verwendet wird, wenn das Modell zu stark an die Trainingsdaten angepasst ist (Overfitting) oder wenn Prädiktoren stark miteinander korrelieren (Multikollinearität). Sie gehört zur Familie der regularisierten Regressionsverfahren.
Bei der gewöhnlichen kleinsten Quadrate-Regression (OLS) werden die Regressionskoeffizienten so geschätzt, dass die Summe der quadrierten Residuen minimiert wird. Die Ridge-Regression fügt dieser Verlustfunktion einen zusätzlichen Strafterm hinzu, der die Größe der Koeffizienten begrenzt. Die zu minimierende Funktion lautet:
Ridge-Verlustfunktion
Dabei ist der Residualterm (wie bei OLS), der Regularisierungsparameter (auch Penalty-Parameter genannt) und die quadrierten Regressionskoeffizienten. Je größer , desto stärker werden die Koeffizienten in Richtung null gedrängt – ohne jedoch genau null zu werden. Deshalb verbleiben alle Prädiktoren im Modell.
Warum ist Ridge-Regression für statistische Analysen wichtig?
Ridge-Regression löst zwei häufig auftretende Probleme in der Regressionsanalyse:
- Multikollinearität: Wenn Prädiktoren stark korrelieren, werden OLS-Schätzer instabil und haben eine hohe Varianz. Ridge-Regression stabilisiert die Schätzungen, indem sie hohe Koeffizienten bestraft.
- Overfitting: Modelle mit vielen Prädiktoren passen sich oft zu sehr den Trainingsdaten an und generalisieren schlecht. Die Regularisierung reduziert diese Überanpassung.
Der entscheidende Parameter ist Lambda (λ). Er wird in der Regel über Kreuzvalidierung (Cross-Validation) bestimmt: Man testet verschiedene λ-Werte und wählt denjenigen, der auf ungesehenen Daten die besten Vorhersagen liefert.
Praxisbeispiel zu Ridge-Regression
Angenommen, du untersuchst in deiner Masterarbeit, welche Faktoren den Studienerfolg (Abschlussnote) vorhersagen. Du hast 15 Prädiktoren erhoben – darunter Abiturnote, Lernstunden pro Woche, Schlafdauer, Stresslevel und mehrere Persönlichkeitsmerkmale. Viele dieser Variablen korrelieren miteinander (z. B. Stress und Schlafdauer).
Eine gewöhnliche OLS-Regression liefert in diesem Fall instabile Koeffizientenschätzungen mit sehr großen Standardfehlern. Du entscheidest dich daher für eine Ridge-Regression:
| Prädiktor | OLS-Koeffizient | Ridge-Koeffizient (λ = 0,5) |
|---|---|---|
| Abiturnote | 0,72 | 0,54 |
| Lernstunden/Woche | −1,43 | −0,61 |
| Stresslevel | 2,18 | 0,89 |
| Schlafdauer | −2,05 | −0,84 |
Man sieht: Die OLS-Koeffizienten sind teils sehr groß und spiegeln die Instabilität durch Multikollinearität wider. Die Ridge-Koeffizienten sind deutlich kleiner und stabiler – das Modell wird robuster, alle Prädiktoren bleiben jedoch erhalten. Das optimale λ wird per 10-facher Kreuzvalidierung bestimmt.