Definition
Das Ausmaß, in dem Testergebnisse konsistent, stabil und frei von Zufallsfehlern über Wiederholungsmessungen, Beurteiler oder gleichwertige Formen sind; Reliabilität betrifft die Präzision von Scores.
Prinzip
Prinzip
Verringere Messfehler durch klare Bewertungsrubriken, standardisierte Durchführung, ausreichende Itemanzahl und Beurteilertraining, sodass beobachtete Werte wahre Unterschiede und nicht Rauschen widerspiegeln.
Demonstration
Demonstration
Eine Schreibrubrik erzielt nach Training hohe Interrater‑Reliabilität: Unabhängige Bewerter vergeben ähnlichen Scores für dieselben Aufsätze und die Test‑Retest‑Korrelation ist über Durchführungen hinweg stark.
Fehlanwendung
Fehlanwendung
Hohe Reliabilität mit Validität gleichsetzen: Ein konsistenter Test kann zuverlässig das falsche Konstrukt messen, oder hohe interne Konsistenz kann aus Item‑Redundanz statt Konstruktbreite resultieren.
Konsequenz
Konsequenz
Reliabele Scores erhöhen die Reproduzierbarkeit von Entscheidungen und erlauben eine sinnvolle Interpretation anderer Validitätsbelege; geringe Reliabilität begrenzt Interpretierbarkeit und vergrößert Entscheidungsunsicherheit.
Umkehrung
Umkehrung
Unzuverlässigkeit: inkonsistente, volatile oder rauschbehaftete Scores, die wahre Unterschiede verschleiern und das Vertrauen in darauf basierende Entscheidungen untergraben.
Abgrenzung
Abgrenzung
Reliabilität ist notwendig, aber nicht hinreichend für gültige Interpretation; sie bezieht sich auf Präzision für bestimmte Verwendungen und Populationen und garantiert nicht die Relevanz des Konstrukts.
Semantische Spannung
Semantische Spannung
Spannung zwischen der Maximierung der Reliabilität (z. B. viele ähnliche Items) und dem Erfassen der Konstruktbreite, wobei zu viel Homogenität Reliabilität erhöht, aber Inhaltsvalidität einschränkt.
Synthese
Synthese
Reliabilität stellt sicher, dass Testergebnisse unter relevanten Bedingungen präzise und konsistent sind; zusammen mit Validitätsbelegen unterstützt sie vertrauenswürdige Entscheidungen über Lernende.