Deze pagina is automatisch vertaald en de nauwkeurigheid van de vertaling kan niet worden gegarandeerd. Raadpleeg de Engelse versie voor een brontekst.

Impact van GPT-gebruik op de schrijfprestaties en cognitieve vaardigheden van essays

4 juli 2025 bijgewerkt door: Simiao Chen, University Hospital Heidelberg

Een gerandomiseerd gecontroleerd onderzoek naar de impact van het gebruik van generatieve kunstmatige intelligentie op analytische schrijfprestaties en cognitieve vaardigheden

Het doel van dit gerandomiseerde gecontroleerde laboratoriumexperiment is om te onderzoeken of het gebruik van gegenereerde kunstmatige intelligentie (AI)-technologie de academische prestaties en cognitieve vaardigheden van mensen zal beïnvloeden in de context van analytisch schrijven onder universiteitsstudenten. De belangrijkste vragen die het wil beantwoorden zijn:

  1. Heeft het gebruik van de technologie invloed op de schrijfprestaties van leerlingen?
  2. Heeft het gebruik van de technologie invloed op de cognitieve inspanning van leerlingen tijdens het schrijfproces?

Deelnemers worden willekeurig toegewezen aan een controlegroep, die schrijft zonder hulp van AI, of aan een experimentele groep, die schrijft met behulp van ChatGPT. Onderzoekers zullen de twee groepen vergelijken om te zien of ChatGPT de schrijfprestaties en cognitieve inspanning van studenten beïnvloedt.

Het laboratoriumexperiment duurt per deelnemer maximaal 1,5 uur. Een eye-tracker bewaakt de blikactiviteiten en de pupilgrootte van de deelnemer. Een functionele nabij-infraroodspectroscopie (fNIRS) zal de hersenactiviteiten van de deelnemer in de frontale kwab volgen. Tijdens het experiment wordt aan de deelnemers gevraagd om:

  1. Lees leermateriaal over analytische schrijftechnieken.
  2. Voer op basis van het eerder verstrekte materiaal een analytische schrijfopdracht uit die ongeveer 30 minuten duurt, met of zonder de hulp van ChatGPT.
  3. Beantwoord enquêtevragen over hun ervaringen met de schrijfopdracht, hun houding ten opzichte van het gebruik van ChatGPT en demografische achtergronden.

Studie Overzicht

Toestand

Voltooid

Interventie / Behandeling

Studietype

Ingrijpend

Inschrijving (Werkelijk)

160

Fase

  • Niet toepasbaar

Contacten en locaties

In dit gedeelte vindt u de contactgegevens van degenen die het onderzoek uitvoeren en informatie over waar dit onderzoek wordt uitgevoerd.

Studie Locaties

      • Heidelberg, Duitsland
        • Core Facility for Neuroscience of Self-Regulation, Heidelberg University

Deelname Criteria

Onderzoekers zoeken naar mensen die aan een bepaalde beschrijving voldoen, de zogenaamde geschiktheidscriteria. Enkele voorbeelden van deze criteria zijn iemands algemene gezondheidstoestand of eerdere behandelingen.

Geschiktheidscriteria

Leeftijden die in aanmerking komen voor studie

  • Volwassen

Accepteert gezonde vrijwilligers

Ja

Beschrijving

Inclusiecriteria:

  • Voltijdstudent aan de universiteit.
  • Kan lezen en schrijven in het Engels.
  • Gebruik de computer de meeste dagen van de week.
  • Ik heb de Graduate Record Examinations (GRE) niet afgelegd en ben er momenteel ook niet mee bezig.
  • Draag geen bril (contactlenzen zijn toegestaan).
  • Geen oogafwijkingen hebben.
  • Gebruik momenteel geen opioïden, epinefrine of antihypertensiva.
  • Tijdens het experiment geen make-up rond de ogen dragen.

Studie plan

Dit gedeelte bevat details van het studieplan, inclusief hoe de studie is opgezet en wat de studie meet.

Hoe is de studie opgezet?

Ontwerpdetails

  • Primair doel: Ander
  • Toewijzing: Gerandomiseerd
  • Interventioneel model: Parallelle opdracht
  • Masker: Enkel

Wapens en interventies

Deelnemersgroep / Arm
Interventie / Behandeling
Experimenteel: Interventie-arm
In de interventie-arm krijgen deelnemers de opdracht om ChatGPT te gebruiken als hulp bij het voltooien van een analytische schrijftaak.
De computerinterface die wordt gebruikt voor het schrijven van essays volgt een ontwerp met een gesplitst scherm. De schrijfinstructies en het tekstinvoerveld worden beheerd op een enquêteplatform, geplaatst op de linkerhelft van het scherm. ChatGPT wordt op de rechterhelft van het scherm geplaatst voor technologische ondersteuning.
Geen tussenkomst: Controle-arm
In de controle-arm krijgen de deelnemers de opdracht om zelfstandig een analytische schrijftaak uit te voeren, zonder toegang tot enige technologische hulp.

Wat meet het onderzoek?

Primaire uitkomstmaten

Uitkomstmaat
Maatregel Beschrijving
Tijdsspanne
Prestaties schrijven
Tijdsspanne: 1,5 uur
De taak voor het schrijven van essays is afgeleid van de sectie Analytisch schrijven in de Graduate Record Examinations (GRE), een wereldwijd en gestandaardiseerd computergebaseerd examen ontwikkeld door de Educational Testing Service (ETS). De essays van de deelnemers worden gescoord op een schaal van 0 tot 6 door een automatische en gevalideerde scoretool van derden die ook door ETS is ontwikkeld.
1,5 uur
Cognitieve inspanning gemeten aan de hand van de pupilgrootte
Tijdsspanne: 1,5 uur
Cognitieve inspanning wordt gekwantificeerd door veranderingen in pupilgrootte te monitoren. Om dit te bereiken worden de pupildiameters tijdens de schrijftaak geregistreerd met behulp van een nabij-infrarood eyetracker, met name het Tobii Pro Fusion-model. Aan het begin van het experiment worden de individuele basispupildiameters gemeten tijdens een ontspanningstaak van 30 seconden.
1,5 uur

Secundaire uitkomstmaten

Uitkomstmaat
Maatregel Beschrijving
Tijdsspanne
Zelfperceptie van schrijfprestaties
Tijdsspanne: 1,5 uur

Dit is een schaal met één item:

Welke score zou uw essay volgens u moeten krijgen, waarbij u dezelfde beoordelingsrubriek als voorheen gebruikt (0 is de laagste en 6 is de hoogste)?

De score varieert van 0 tot 6. Een hogere score duidt op een hogere zelfwaargenomen schrijfprestatie. De variabele wordt behandeld als een continue variabele.

1,5 uur
Zelfperceptie van cognitieve inspanning
Tijdsspanne: 1,5 uur

Dit is een Likert-schaal met één item, aangepast van de taakbelastingsindex van de National Aeronautics and Space Administration (NASA-TLX; Hart, 2006; Hart & Staveland, 1988):

Beoordeel op een schaal van 1 tot 7 hoe hard u moet werken om uw prestatieniveau te bereiken.

De Likert-score varieert van 1 tot 7 (1 is ‘zeer laag’ en 7 is ‘zeer hoog’). Een hogere score duidt op een hogere zelf waargenomen cognitieve inspanning. De variabele wordt behandeld als een continue variabele.

Referenties:

  1. Hart, SG (2006). NASA-taakbelastingindex (NASA-TLX); 20 jaar later. Proceedings van de jaarlijkse bijeenkomst van de Human Factors and Ergonomics Society. https://doi.org/10.1177/154193120605000909
  2. Hart, SG, & Staveland, LE (1988). Ontwikkeling van NASA-TLX (Task Load Index): Resultaten van empirisch en theoretisch onderzoek. In Vooruitgang in de psychologie (Vol. 52, blz. 139-183). Noord-Holland.
1,5 uur
Cognitieve inspanning gemeten aan de hand van corticale hemodynamische activiteit in de frontale kwab
Tijdsspanne: 1,5 uur
Cognitieve inspanning wordt gekwantificeerd door veranderingen in de corticale hemodynamische activiteit in de frontale kwab te monitoren. Om dit te bereiken wordt de hersenactiviteit gedurende de hele schrijftaak geregistreerd met behulp van een functionele nabij-infraroodspectroscopie (fNIRS), specifiek het NIRSport2-model.
1,5 uur
Zelfperceptie van stress
Tijdsspanne: 1,5 uur

Dit is een Likert-subschaal met één item, aangepast van de Primary Appraisal Secondary Appraisal-schaal (PASA; Gaab, 2009; Pollak et al., 2020):

Op een schaal van 1 tot 7, in hoeverre bent u het eens of oneens met de volgende stelling over waargenomen stress: De analytische schrijfopdracht was voor mij stressvol.

De Likert-score loopt van 1 tot 7 (1 staat voor ‘helemaal mee oneens’ en 7 voor ‘helemaal mee eens’). Een hogere score duidt op een hogere zelf ervaren stress. De variabele wordt behandeld als een continue variabele.

Referenties:

  1. Gaab, J. (2009). PASA-Primaire Beoordeling Secundaire Beoordeling. Een vragenlijst voor de beoordeling van cognitieve beoordelingen van situaties. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B., & Kozusznik, M.W. (2020). Stress in handmatige en autonome manieren van samenwerken met een cobot. Computers in menselijk gedrag, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 uur
Zelfperceptie van uitdagingen
Tijdsspanne: 1,5 uur

Dit is een Likert-subschaal met één item, aangepast van de Primary Appraisal Secondary Appraisal-schaal (PASA; Gaab, 2009; Pollak et al., 2020):

Op een schaal van 1 tot 7, in hoeverre bent u het eens of oneens met de volgende stelling over de ervaren uitdaging: Ik vind de analytische schrijfopdracht een uitdaging.

De Likert-score loopt van 1 tot 7 (1 staat voor ‘helemaal mee oneens’ en 7 voor ‘helemaal mee eens’). Een hogere score duidt op een grotere zelf ervaren uitdaging. De variabele wordt behandeld als een continue variabele.

Referenties:

  1. Gaab, J. (2009). PASA-Primaire Beoordeling Secundaire Beoordeling. Een vragenlijst voor de beoordeling van cognitieve beoordelingen van situaties. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B., & Kozusznik, M.W. (2020). Stress in handmatige en autonome manieren van samenwerken met een cobot. Computers in menselijk gedrag, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 uur
Zelfeffectiviteit tijdens het schrijven
Tijdsspanne: 1,5 uur

Dit is een Likert-schaal met zestien items die drie dimensies van de zelfeffectiviteit bij het schrijven meet: ideevorming, conventie en zelfregulering (Bruning et al., 2013). De Likert-score loopt van 1 tot 7 (1 staat voor ‘helemaal mee oneens’ en 7 voor ‘helemaal mee eens’). Een hogere score duidt op een hogere zelfeffectiviteit. De drie dimensies worden afzonderlijk behandeld, elk als een continue variabele.

Referentie:

1. Bruning, R., Dempsey, M., Kauffman, D.F., McKim, C., & Zumbrunn, S. (2013). Onderzoek naar de dimensies van zelfeffectiviteit bij het schrijven. Tijdschrift voor onderwijspsychologie, 105(1), 25.

1,5 uur
Situationele interesse in analytisch schrijven
Tijdsspanne: 1,5 uur

Dit is een Likert-schaal met vier items, aangepast van de situationele interesseschaal (Hulleman et al., 2010). Deze schaal meet de situationele interesse van deelnemers in analytisch schrijven:

Op een schaal van 1 tot 7, in hoeverre bent u het eens of oneens met de volgende uitspraken over uw interesse in de analytische schrijfopdracht die u zojuist hebt voltooid?

  1. De analytische schrijfopdracht was interessant.
  2. Het was leuk om aan het essay te werken.
  3. Ik vond het schrijven van het essay leuk.
  4. De analytische schrijfopdracht was leuk.

De Likert-score loopt van 1 tot 7 (1 staat voor ‘helemaal mee oneens’ en 7 voor ‘helemaal mee eens’). Een hogere score duidt op een hogere situationele interesse. De variabele wordt behandeld als een continue variabele.

Referentie:

1. Hulleman, C.S., Godes, O., Hendricks, B.L., & Harackiewicz, J.M. (2010). Het vergroten van interesse en prestaties met een interventie op het gebied van gebruikswaarde. Journal of Onderwijspsychologie, 102(4), 880.

1,5 uur
Gedragsintentie bij het gebruik van ChatGPT
Tijdsspanne: 1,5 uur

Dit is een Likert-schaal met twee items die de gedragsintentie van deelnemers meet om ChatGPT in de toekomst te gebruiken voor het schrijven van essays (Albayati, 2024):

Op een schaal van 1 tot 7, in hoeverre bent u het eens of oneens met de volgende uitspraken over het gebruik van ChatGPT bij het schrijven van essays?

  1. Als ik toegang heb tot ChatGPT, zou ik het gebruiken voor het schrijven van essays.
  2. Ik ben van plan ChatGPT in de toekomst te gebruiken als ik een essay-schrijftaak heb.

De Likert-score loopt van 1 tot 7 (1 staat voor ‘helemaal mee oneens’ en 7 voor ‘helemaal mee eens’). Een hogere score duidt op een hogere gedragsintentie bij het gebruik van ChatGPT. De variabele wordt behandeld als een continue variabele.

Referentie:

1. Albayati, H. (2024). Onderzoek naar de perceptie en het bewustzijn van studenten over het gebruik van ChatGPT als regulier hulpmiddel: een onderzoek naar het perspectief van gebruikersacceptatie. Computers en onderwijs: kunstmatige intelligentie, 6, 100203. https://doi.org/10.1016/j.caeai.2024.100203

1,5 uur

Medewerkers en onderzoekers

Hier vindt u mensen en organisaties die betrokken zijn bij dit onderzoek.

Onderzoekers

  • Hoofdonderzoeker: Till Bärnighausen, Heidelberg Institute of Global Health

Studie record data

Deze datums volgen de voortgang van het onderzoeksdossier en de samenvatting van de ingediende resultaten bij ClinicalTrials.gov. Studieverslagen en gerapporteerde resultaten worden beoordeeld door de National Library of Medicine (NLM) om er zeker van te zijn dat ze voldoen aan specifieke kwaliteitscontrolenormen voordat ze op de openbare website worden geplaatst.

Bestudeer belangrijke data

Studie start (Werkelijk)

18 juli 2024

Primaire voltooiing (Werkelijk)

20 februari 2025

Studie voltooiing (Werkelijk)

20 februari 2025

Studieregistratiedata

Eerst ingediend

15 juli 2024

Eerst ingediend dat voldeed aan de QC-criteria

15 juli 2024

Eerst geplaatst (Werkelijk)

19 juli 2024

Updates van studierecords

Laatste update geplaatst (Werkelijk)

9 juli 2025

Laatste update ingediend die voldeed aan QC-criteria

4 juli 2025

Laatst geverifieerd

1 juli 2025

Meer informatie

Termen gerelateerd aan deze studie

Andere studie-ID-nummers

  • S-117/2024

Informatie over medicijnen en apparaten, studiedocumenten

Bestudeert een door de Amerikaanse FDA gereguleerd geneesmiddel

Nee

Bestudeert een door de Amerikaanse FDA gereguleerd apparaatproduct

Nee

product vervaardigd in en geëxporteerd uit de V.S.

Nee

Deze informatie is zonder wijzigingen rechtstreeks van de website clinicaltrials.gov gehaald. Als u verzoeken heeft om uw onderzoeksgegevens te wijzigen, te verwijderen of bij te werken, neem dan contact op met register@clinicaltrials.gov. Zodra er een wijziging wordt doorgevoerd op clinicaltrials.gov, wordt deze ook automatisch bijgewerkt op onze website .

Abonneren