Studie van 14.637 chatbotantwoorden: LLM-tutoren leggen vooral uit en lossen op, echt begeleiden doen ze zelden
hoger-onderwijs informatica-digitale-competenties onderzoek-en-evidentiedidactiek-en-lespraktijk internationaal academische-publicatie
Onderzoekers analyseerden 14.637 antwoorden van een LLM-tutor aan 203 studenten in een universitair vak over artificiële intelligentie, om na te gaan hoeveel directe hulp zulke chatbots geven in authentieke leerinteracties. Ze ontwikkelden daarvoor een vijfpuntsschaal voor “scaffolding” — de mate waarin een antwoord het werk voor de student doet — die werd gevalideerd tegen menselijke annotaties. Het resultaat is opvallend eenzijdig: meer dan 95 procent van de antwoorden zat in de twee hoogste hulpcategorieën, uitleggen of gewoon oplossen, terwijl echt begeleidende antwoorden die studenten zelf laten denken zeldzaam waren. Het scaffoldingniveau hing wel samen met het verdere gespreksgedrag van studenten, maar voegde weinig voorspellende waarde toe voor de resultaten op drie latere examens bovenop eerdere prestaties. Voor wie lesgeeft bevestigt dit met harde cijfers wat velen vermoeden: een standaard-chatbot gedraagt zich als antwoordenmachine, niet als tutor, en wie AI pedagogisch wil inzetten moet dat gedrag bewust bijsturen.
Bron: LLM Pedagogical Behavior in AI Tutoring Interactions (arXiv preprint cs.CL, 2026, Engelstalig).