
S2E1 | Bewertungs- und Feedbacktools auf dem Prüfstand
Zehn Schülertexte, zehn Bewertungen – und teilweise völlig unterschiedliche Ergebnisse. Für Rainer Mühlhoff ist der Fall klar: KI-basierte Korrektur- und Feedbacksysteme sind zu unzuverlässig für die Leistungsbewertung.Aber tragen die Daten diese Schlussfolgerung wirklich? Wir schauen uns zwei Studien von Mühlhoff genauer an und fragen, was sie tatsächlich über Variabilität, Reliabilität und die Qualität von KI-Feedback zeigen – und was die Forschung zum Vergleich von menschlicher und automatisierter Bewertung dazu sagt.Mühlhoff, R., & Henningsen, M. (2024). Chatbots im Schulunterricht: Wir…
The skinny
The skinny isn't ready yet — notes appear once the transcript is processed.