Beyond Polishing: An Exploratory Comparison of Editor- and Challenger-Style AI Prompts on Problem Framing in Data Science Education

  • Generative AI tutoring tools predominantly refine the wording, structure, and feasibility of a student’s initial problem framing. Whether AI assistance that instead poses counter-proposals – alternative framings, stakeholder perspectives, and questioned assumptions – changes the originality of the resulting framing is an open empirical question for data science education. This thesis investigates that Question in an exploratory study with thirty postgraduate students at Universität Koblenz. Each participant interacted with a bespoke web platform that walked them through three fixed-order stages on a sharedWi-Fi-dormitory dataset description: an Editorstyle AI stage, a Challenger-style AI stage, and a final unassisted synthesis. The final synthesis topic was rated on four dimensions (originality, feasibility, reasoning quality, clarity) byGenerative AI tutoring tools predominantly refine the wording, structure, and feasibility of a student’s initial problem framing. Whether AI assistance that instead poses counter-proposals – alternative framings, stakeholder perspectives, and questioned assumptions – changes the originality of the resulting framing is an open empirical question for data science education. This thesis investigates that Question in an exploratory study with thirty postgraduate students at Universität Koblenz. Each participant interacted with a bespoke web platform that walked them through three fixed-order stages on a sharedWi-Fi-dormitory dataset description: an Editorstyle AI stage, a Challenger-style AI stage, and a final unassisted synthesis. The final synthesis topic was rated on four dimensions (originality, feasibility, reasoning quality, clarity) by a human expert rater and an LLM second rater (Anthropic Claude) blinded to group assignment. Because the planned counterbalanced within-subjects crossover could not be implemented, participants were sorted post hoc into an Editor-influenced and a Challengerinfluenced group based on triangulated self-reported impact and preference. Topics from the Challenger-influenced group were rated substantially higher on originality (Cohen’s d = 3.67, 95% CI [2.50, 4.84], p < .001, ICC = 0.859); topics from the Editor-influenced group were rated higher on feasibility (d = −2.04, 95% CI [−2.92,−1.16]) and clarity (d = −1.07, 95% CI [−1.84,−0.30]); a secondary unexpected association favoured the Challenger-influenced group on reasoning Quality (d = 1.03, 95% CI [0.27, 1.79]). The latter three dimensions had inter-rater reliability below the pre-specified 0.70 threshold and their effect-size magnitudes are interpreted as exploratory estimates. Perception data and open-ended responses suggested participants treated the two AI styles as functional complements assigned to distinct task-contexts, and 94% indicated interest in an integrated switcher mode. Because the analytic groups were defined by self-report and because the stage order was fixed, these results should be read as associations rather than causal effects of prompt style. The thesis contributes (a) empirical evidence of large betweengroup differences in framing originality consistent with a counter-proposal mechanism; (b) a methodological case study of a hybrid human-LLM rating protocol with dimension-specific reliability documentation; and (c) design directions for educational AI tools that surface, rather than choose for the learner, the kind of cognitive assistance offered.show moreshow less
  • Generative KI-Tutorensysteme verfeinern überwiegend Formulierung, Struktur und Machbarkeit der Ausgangsformulierung eines Problems durch die Studierenden. Ob KI-Unterstützung, die stattdessen Gegenvorschläge unterbreitet – alternative Problemrahmungen, Stakeholder-Perspektiven und das Hinterfragen von Annahmen –, die Originalität der resultierenden Problemformulierung verändert, ist eine offene empirische Frage für die Datenwissenschaftsausbildung. Diese Arbeit untersucht diese Frage in einer explorativen Studie mit dreißig Masterstudierenden der Universität Koblenz. Jede Teilnehmerin und jeder Teilnehmer interagierte mit einer eigens entwickelten Web-Plattform, die durch drei aufeinanderfolgende Phasen führte: eine Editor-KI-Phase, eine Challenger-KI-Phase und eine abschließende KI-freie Synthese. Das Endthema wurde auf vier DimensionenGenerative KI-Tutorensysteme verfeinern überwiegend Formulierung, Struktur und Machbarkeit der Ausgangsformulierung eines Problems durch die Studierenden. Ob KI-Unterstützung, die stattdessen Gegenvorschläge unterbreitet – alternative Problemrahmungen, Stakeholder-Perspektiven und das Hinterfragen von Annahmen –, die Originalität der resultierenden Problemformulierung verändert, ist eine offene empirische Frage für die Datenwissenschaftsausbildung. Diese Arbeit untersucht diese Frage in einer explorativen Studie mit dreißig Masterstudierenden der Universität Koblenz. Jede Teilnehmerin und jeder Teilnehmer interagierte mit einer eigens entwickelten Web-Plattform, die durch drei aufeinanderfolgende Phasen führte: eine Editor-KI-Phase, eine Challenger-KI-Phase und eine abschließende KI-freie Synthese. Das Endthema wurde auf vier Dimensionen (Originalität, Machbarkeit, Begründungsqualität, Klarheit) von einer domänenkundigen Person sowie von einem LLM-Zweitbewerter (Anthropic Claude), beide verblindet für die Gruppenzugehörigkeit, bewertet. Da das ursprünglich geplante kontrollierte Crossover-Design nicht umgesetzt werden konnte, wurden die Teilnehmenden post-hoc in eine Editor-beeinflusste und eine Challenger-beeinflusste Gruppe sortiert, basierend auf triangulierten Selbstauskunfts- und Präferenzdaten. Themen aus der Challenger-beeinflussten Gruppe erhielten deutlich höhere Originalitätsbewertungen (Cohens d = 3.67, 95% KI [2.50, 4.84]); Themen aus der Editor-beeinflussten Gruppe waren machbarer und klarer formuliert. Ein unerwarteter Sekundäreffekt zeigte sich zugunsten der Challenger-beeinflussten Gruppe in der Begründungsqualität. Aufgrund der post-hoc definierten Gruppen und der festen Reihenfolge sind diese Ergebnisse als Assoziationen, nicht als kausale Wirkungen, zu lesen. Die Arbeit liefert empirische Hinweise, methodische Dokumentation eines hybriden Mensch-LLM-Bewertungsverfahrens und Designhinweise für Bildungs-KI-Werkzeuge.show moreshow less

Download full text files

Export metadata

Additional Services

Search Google Scholar
Metadaten
Author:Chisom Onwumere
URN:urn:nbn:de:hbz:kob7-26900
DOI:https://doi.org/10.82549/opus4-2690
Referee:Frank Hopfgartner, Stefania Zourlidou
Document Type:Master's Thesis
Language:English
Date of Publication (online):2026/07/15
Date of first Publication:2026/07/15
Publishing Institution:Universität Koblenz, Universitätsbibliothek
Granting Institution:Universität Koblenz, Fachbereich 4
Date of final exam:2026/06/18
Release Date:2026/07/15
Page Number:xvii, 55
Institutes:Fachbereich 4 / Institute for Web Science and Technologies
Licence (German): CC BY-SA - Namensnennung-Share Alike 4.0 International
Einverstanden ✔
Diese Webseite verwendet technisch erforderliche Session-Cookies. Durch die weitere Nutzung der Webseite stimmen Sie diesem zu. Unsere Datenschutzerklärung finden Sie hier.