Diese Seite wurde automatisch übersetzt und die Genauigkeit der Übersetzung wird nicht garantiert. Bitte wende dich an die englische Version für einen Quelltext.

Einfluss der GPT-Nutzung auf die Leistung beim Schreiben von Essays und die kognitiven Fähigkeiten

4. Juli 2025 aktualisiert von: Simiao Chen, University Hospital Heidelberg

Eine randomisierte kontrollierte Studie über die Auswirkungen des Einsatzes generativer künstlicher Intelligenz auf die analytische Schreibleistung und die kognitiven Fähigkeiten

Das Ziel dieses randomisierten, kontrollierten Laborexperimentes besteht darin, zu untersuchen, ob der Einsatz generierter künstlicher Intelligenz (KI)-Technologie die akademische Leistung und die kognitiven Fähigkeiten von Menschen im Kontext des analytischen Schreibens von College-Studenten beeinflusst. Die wichtigsten Fragen, die beantwortet werden sollen, sind:

  1. Beeinflusst der Einsatz der Technologie die Schreibleistung der Schüler?
  2. Beeinflusst der Einsatz der Technologie die kognitive Leistung der Schüler während des Schreibprozesses?

Die Teilnehmer werden nach dem Zufallsprinzip entweder einer Kontrollgruppe, die ohne KI-Unterstützung schreibt, oder einer Experimentalgruppe, die mit Unterstützung von ChatGPT schreibt, zugeordnet. Die Forscher werden die beiden Gruppen vergleichen, um zu sehen, ob ChatGPT die Schreibleistung und die kognitiven Anstrengungen der Schüler beeinflusst.

Für jeden Teilnehmer dauert das Laborexperiment maximal 1,5 Stunden. Ein Eye-Tracker überwacht die Blickaktivitäten und die Pupillengröße des Teilnehmers. Eine funktionelle Nahinfrarotspektroskopie (fNIRS) überwacht die Gehirnaktivitäten des Teilnehmers im Frontallappen. Während des Experiments werden die Teilnehmer gebeten:

  1. Lesen Sie Lernmaterialien zu analytischen Schreibtechniken.
  2. Vervollständigen Sie auf der Grundlage der zuvor bereitgestellten Materialien eine analytische Schreibaufgabe, die mit oder ohne Hilfe von ChatGPT etwa 30 Minuten dauert.
  3. Beantworten Sie Umfragefragen zu ihren Erfahrungen mit der Schreibaufgabe, ihren Einstellungen zur Verwendung von ChatGPT und ihrem demografischen Hintergrund.

Studienübersicht

Status

Abgeschlossen

Intervention / Behandlung

Studientyp

Interventionell

Einschreibung (Tatsächlich)

160

Phase

  • Unzutreffend

Kontakte und Standorte

Dieser Abschnitt enthält die Kontaktdaten derjenigen, die die Studie durchführen, und Informationen darüber, wo diese Studie durchgeführt wird.

Studienorte

      • Heidelberg, Deutschland
        • Core Facility for Neuroscience of Self-Regulation, Heidelberg University

Teilnahmekriterien

Forscher suchen nach Personen, die einer bestimmten Beschreibung entsprechen, die als Auswahlkriterien bezeichnet werden. Einige Beispiele für diese Kriterien sind der allgemeine Gesundheitszustand einer Person oder frühere Behandlungen.

Zulassungskriterien

Studienberechtigtes Alter

  • Erwachsene

Akzeptiert gesunde Freiwillige

Ja

Beschreibung

Einschlusskriterien:

  • Vollzeitstudent an der Universität.
  • Kann auf Englisch lesen und schreiben.
  • Benutzen Sie den Computer an den meisten Tagen der Woche.
  • Sie haben die Graduate Record Examinations (GRE) nicht abgelegt und bereiten sich derzeit auch nicht darauf vor.
  • Tragen Sie keine Brille (Kontaktlinsen sind erlaubt).
  • Keine Sehbehinderung haben.
  • Nehmen Sie derzeit keine Opioide, Adrenalin oder blutdrucksenkende Medikamente ein.
  • Tragen Sie während des Experiments kein Make-up im Augenbereich.

Studienplan

Dieser Abschnitt enthält Einzelheiten zum Studienplan, einschließlich des Studiendesigns und der Messung der Studieninhalte.

Wie ist die Studie aufgebaut?

Designdetails

  • Hauptzweck: Sonstiges
  • Zuteilung: Zufällig
  • Interventionsmodell: Parallele Zuordnung
  • Maskierung: Single

Waffen und Interventionen

Teilnehmergruppe / Arm
Intervention / Behandlung
Experimental: Interventionsarm
Im Interventionsarm werden die Teilnehmer angewiesen, ChatGPT zur Unterstützung bei der Erledigung einer analytischen Schreibaufgabe zu verwenden.
Die für die Essay-Schreibaufgabe verwendete Computerschnittstelle folgt einem Split-Screen-Design. Die Schreibanweisungen und das Texteingabefeld werden auf einer Umfrageplattform verwaltet, die auf der linken Bildschirmhälfte platziert ist. ChatGPT wird zur technischen Unterstützung auf der rechten Bildschirmhälfte platziert.
Kein Eingriff: Steuerarm
Im Kontrollarm werden die Teilnehmer angewiesen, eine analytische Schreibaufgabe selbstständig und ohne Zugang zu technischer Unterstützung zu erledigen.

Was misst die Studie?

Primäre Ergebnismessungen

Ergebnis Maßnahme
Maßnahmenbeschreibung
Zeitfenster
Schreibleistung
Zeitfenster: 1,5 Stunden
Die Aufgabe zum Schreiben von Aufsätzen leitet sich aus dem Abschnitt „Analytisches Schreiben“ der Graduate Record Examinations (GRE) ab, einer weltweiten und standardisierten computergestützten Prüfung, die vom Educational Testing Service (ETS) entwickelt wurde. Die Aufsätze der Teilnehmer werden auf einer Skala von 0 bis 6 durch ein automatisches und validiertes Bewertungstool eines Drittanbieters bewertet, das ebenfalls von ETS entwickelt wurde.
1,5 Stunden
Kognitive Anstrengung gemessen an der Schülergröße
Zeitfenster: 1,5 Stunden
Die kognitive Anstrengung wird durch die Überwachung von Veränderungen der Pupillengröße quantifiziert. Um dies zu erreichen, werden die Pupillendurchmesser während der gesamten Schreibaufgabe mit einem Nahinfrarot-Eyetracker, insbesondere dem Modell Tobii Pro Fusion, aufgezeichnet. Zu Beginn des Experiments werden die einzelnen Grundpupillendurchmesser während einer 30-sekündigen Entspannungsaufgabe gemessen.
1,5 Stunden

Sekundäre Ergebnismessungen

Ergebnis Maßnahme
Maßnahmenbeschreibung
Zeitfenster
Selbstwahrnehmung der Schreibleistung
Zeitfenster: 1,5 Stunden

Dies ist eine Ein-Item-Skala:

Welche Punktzahl sollte Ihr Aufsatz Ihrer Meinung nach unter Verwendung der gleichen Bewertungsrubrik wie zuvor erhalten (0 ist die niedrigste und 6 die höchste)?

Die Punktzahl reicht von 0 bis 6. Eine höhere Punktzahl weist auf eine höhere selbst eingeschätzte Schreibleistung hin. Die Variable wird als kontinuierliche Variable behandelt.

1,5 Stunden
Selbstwahrnehmung kognitiver Anstrengung
Zeitfenster: 1,5 Stunden

Hierbei handelt es sich um eine einstufige Likert-Skala, die aus dem Aufgabenlastindex der National Aeronautics and Space Administration (NASA-TLX; Hart, 2006; Hart & Staveland, 1988) übernommen wurde:

Bewerten Sie auf einer Skala von 1 bis 7, wie hart Sie arbeiten müssen, um Ihr Leistungsniveau zu erreichen.

Der Likert-Score reicht von 1 bis 7 (1 bedeutet „sehr niedrig“ und 7 bedeutet „sehr hoch“). Ein höherer Wert weist auf eine höhere selbst wahrgenommene kognitive Anstrengung hin. Die Variable wird als kontinuierliche Variable behandelt.

Verweise:

  1. Hart, SG (2006). Nasa-Task Load Index (NASA-TLX); 20 Jahre später. Tagungsband der Jahrestagung der Human Factors and Ergonomie Society. https://doi.org/10.1177/154193120605000909
  2. Hart, S. G. & Staveland, L. E. (1988). Entwicklung des NASA-TLX (Task Load Index): Ergebnisse empirischer und theoretischer Forschung. In Advances in Psychology (Bd. 52, S. 139-183). Nordholland.
1,5 Stunden
Kognitive Anstrengung gemessen durch kortikale hämodynamische Aktivität im Frontallappen
Zeitfenster: 1,5 Stunden
Die kognitive Anstrengung wird durch die Überwachung von Veränderungen der kortikalen hämodynamischen Aktivität im Frontallappen quantifiziert. Um dies zu erreichen, wird die Gehirnaktivität während der gesamten Schreibaufgabe mithilfe einer funktionellen Nahinfrarotspektroskopie (fNIRS), insbesondere des NIRSport2-Modells, aufgezeichnet.
1,5 Stunden
Selbstwahrnehmung von Stress
Zeitfenster: 1,5 Stunden

Dabei handelt es sich um eine Likert-Unterskala mit einem Item, die an die Skala „Primary Appraisal Secondary Appraisal“ (PASA; Gaab, 2009; Pollak et al., 2020) angelehnt ist:

Auf einer Skala von 1 bis 7, wie sehr würden Sie der folgenden Aussage zum wahrgenommenen Stress zustimmen oder nicht zustimmen: Die Aufgabe zum analytischen Schreiben war für mich stressig.

Der Likert-Score reicht von 1 bis 7 (1 bedeutet „stimme überhaupt nicht zu“ und 7 bedeutet „stimme völlig zu“). Ein höherer Wert weist auf einen höheren selbst wahrgenommenen Stress hin. Die Variable wird als kontinuierliche Variable behandelt.

Verweise:

  1. Gaab, J. (2009). PASA-Primäre Beurteilung. Sekundäre Beurteilung. Ein Fragebogen zur Erfassung kognitiver Situationsbeurteilungen. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B. & Kozusznik, M. W. (2020). Stress bei manueller und autonomer Zusammenarbeit mit einem Cobot. Computer im menschlichen Verhalten, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 Stunden
Selbstwahrnehmung der Herausforderung
Zeitfenster: 1,5 Stunden

Dabei handelt es sich um eine Likert-Unterskala mit einem Item, die an die Skala „Primary Appraisal Secondary Appraisal“ (PASA; Gaab, 2009; Pollak et al., 2020) angelehnt ist:

Auf einer Skala von 1 bis 7, wie sehr würden Sie der folgenden Aussage zur wahrgenommenen Herausforderung zustimmen oder nicht zustimmen: Ich finde die Aufgabe zum analytischen Schreiben eine Herausforderung.

Der Likert-Score reicht von 1 bis 7 (1 bedeutet „stimme überhaupt nicht zu“ und 7 bedeutet „stimme völlig zu“). Eine höhere Punktzahl weist auf eine höhere selbst wahrgenommene Herausforderung hin. Die Variable wird als kontinuierliche Variable behandelt.

Verweise:

  1. Gaab, J. (2009). PASA-Primäre Beurteilung. Sekundäre Beurteilung. Ein Fragebogen zur Erfassung kognitiver Situationsbeurteilungen. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B. & Kozusznik, M. W. (2020). Stress bei manueller und autonomer Zusammenarbeit mit einem Cobot. Computer im menschlichen Verhalten, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 Stunden
Selbstwirksamkeit beim Schreiben
Zeitfenster: 1,5 Stunden

Dabei handelt es sich um eine sechzehn Punkte umfassende Likert-Skala, die drei Dimensionen der Selbstwirksamkeit beim Schreiben misst: Ideenfindung, Konvention und Selbstregulierung (Bruning et al., 2013). Der Likert-Score reicht von 1 bis 7 (1 bedeutet „stimme überhaupt nicht zu“ und 7 bedeutet „stimme völlig zu“). Ein höherer Wert weist auf eine höhere Selbstwirksamkeit hin. Die drei Dimensionen werden separat behandelt, jeweils als kontinuierliche Variable.

Referenz:

1. Bruning, R., Dempsey, M., Kauffman, D. F., McKim, C. & Zumbrunn, S. (2013). Untersuchung der Dimensionen der Selbstwirksamkeit beim Schreiben. Zeitschrift für Pädagogische Psychologie, 105(1), 25.

1,5 Stunden
Situatives Interesse am analytischen Schreiben
Zeitfenster: 1,5 Stunden

Hierbei handelt es sich um eine aus vier Elementen bestehende Likert-Skala, die an die Situationsinteressenskala angelehnt ist (Hulleman et al., 2010). Diese Skala misst das situative Interesse der Teilnehmer am analytischen Schreiben:

Auf einer Skala von 1 bis 7, wie sehr würden Sie den folgenden Aussagen zu Ihrem Interesse an der gerade abgeschlossenen analytischen Schreibaufgabe zustimmen oder nicht zustimmen?

  1. Die Aufgabe zum analytischen Schreiben war interessant.
  2. Die Arbeit an dem Aufsatz hat Spaß gemacht.
  3. Es hat mir Spaß gemacht, den Aufsatz zu schreiben.
  4. Die Aufgabe zum analytischen Schreiben hat mir viel Spaß gemacht.

Der Likert-Score reicht von 1 bis 7 (1 bedeutet „stimme überhaupt nicht zu“ und 7 bedeutet „stimme völlig zu“). Eine höhere Punktzahl weist auf ein höheres Situationsinteresse hin. Die Variable wird als kontinuierliche Variable behandelt.

Referenz:

1. Hulleman, C. S., Godes, O., Hendricks, B. L. & Harackiewicz, J. M. (2010). Steigerung von Interesse und Leistung durch eine Nutzwertintervention. Zeitschrift für Pädagogische Psychologie, 102(4), 880.

1,5 Stunden
Verhaltensabsicht bei der Verwendung von ChatGPT
Zeitfenster: 1,5 Stunden

Hierbei handelt es sich um eine Likert-Skala mit zwei Elementen, die die Verhaltensabsicht der Teilnehmer misst, ChatGPT in Zukunft für Aufsatzschreibaufgaben zu verwenden (Albayati, 2024):

Auf einer Skala von 1 bis 7, wie sehr würden Sie den folgenden Aussagen zur Verwendung von ChatGPT beim Verfassen von Aufsätzen zustimmen oder nicht zustimmen?

  1. Wenn ich Zugriff auf ChatGPT hätte, würde ich es zum Schreiben von Aufsätzen verwenden.
  2. Ich habe vor, ChatGPT in Zukunft zu verwenden, wenn ich eine Aufgabe zum Schreiben von Aufsätzen habe.

Der Likert-Score reicht von 1 bis 7 (1 bedeutet „stimme überhaupt nicht zu“ und 7 bedeutet „stimme völlig zu“). Eine höhere Punktzahl weist auf eine höhere Verhaltensabsicht bei der Nutzung von ChatGPT hin. Die Variable wird als kontinuierliche Variable behandelt.

Referenz:

1. Albayati, H. (2024). Untersuchung der Wahrnehmung und des Bewusstseins von Studenten im Grundstudium hinsichtlich der Verwendung von ChatGPT als regelmäßiges Hilfstool: Eine Studie zur Benutzerakzeptanzperspektive. Computer und Bildung: Künstliche Intelligenz, 6, 100203. https://doi.org/10.1016/j.caeai.2024.100203

1,5 Stunden

Mitarbeiter und Ermittler

Hier finden Sie Personen und Organisationen, die an dieser Studie beteiligt sind.

Ermittler

  • Hauptermittler: Till Bärnighausen, Heidelberg Institute of Global Health

Studienaufzeichnungsdaten

Diese Daten verfolgen den Fortschritt der Übermittlung von Studienaufzeichnungen und zusammenfassenden Ergebnissen an ClinicalTrials.gov. Studienaufzeichnungen und gemeldete Ergebnisse werden von der National Library of Medicine (NLM) überprüft, um sicherzustellen, dass sie bestimmten Qualitätskontrollstandards entsprechen, bevor sie auf der öffentlichen Website veröffentlicht werden.

Haupttermine studieren

Studienbeginn (Tatsächlich)

18. Juli 2024

Primärer Abschluss (Tatsächlich)

20. Februar 2025

Studienabschluss (Tatsächlich)

20. Februar 2025

Studienanmeldedaten

Zuerst eingereicht

15. Juli 2024

Zuerst eingereicht, das die QC-Kriterien erfüllt hat

15. Juli 2024

Zuerst gepostet (Tatsächlich)

19. Juli 2024

Studienaufzeichnungsaktualisierungen

Letztes Update gepostet (Tatsächlich)

9. Juli 2025

Letztes eingereichtes Update, das die QC-Kriterien erfüllt

4. Juli 2025

Zuletzt verifiziert

1. Juli 2025

Mehr Informationen

Begriffe im Zusammenhang mit dieser Studie

Andere Studien-ID-Nummern

  • S-117/2024

Arzneimittel- und Geräteinformationen, Studienunterlagen

Studiert ein von der US-amerikanischen FDA reguliertes Arzneimittelprodukt

Nein

Studiert ein von der US-amerikanischen FDA reguliertes Geräteprodukt

Nein

Produkt, das in den USA hergestellt und aus den USA exportiert wird

Nein

Diese Informationen wurden ohne Änderungen direkt von der Website clinicaltrials.gov abgerufen. Wenn Sie Ihre Studiendaten ändern, entfernen oder aktualisieren möchten, wenden Sie sich bitte an register@clinicaltrials.gov. Sobald eine Änderung auf clinicaltrials.gov implementiert wird, wird diese automatisch auch auf unserer Website aktualisiert .

Abonnieren