Denne side blev automatisk oversat, og nøjagtigheden af ​​oversættelsen er ikke garanteret. Der henvises til engelsk version for en kildetekst.

Indvirkning af GPT-brug på essayskrivningspræstationer og kognitive evner

4. juli 2025 opdateret af: Simiao Chen, University Hospital Heidelberg

Et randomiseret kontrolleret forsøg på virkningen af ​​at bruge generativ kunstig intelligens på analytisk skrivepræstation og kognitive evner

Målet med dette randomiserede kontrollerede laboratorieeksperiment er at undersøge, om brug af genereret kunstig intelligens (AI) teknologi vil påvirke folks akademiske præstationer og kognitive evner i forbindelse med analytisk skrivning blandt universitetsstuderende. De vigtigste spørgsmål, den sigter mod at besvare er:

  1. Påvirker brugen af ​​teknologien elevernes skrivepræstation?
  2. Påvirker brugen af ​​teknologien elevernes kognitive indsats under skriveprocessen?

Deltagerne vil blive tilfældigt tildelt til enten en kontrolgruppe, som skriver uden AI-hjælp, eller en eksperimentel gruppe, som skriver med hjælp fra ChatGPT. Forskere vil sammenligne de to grupper for at se, om ChatGPT påvirker elevernes skrivepræstation og kognitive indsats.

For hver deltager vil laboratorieeksperimentet ikke vare mere end 1,5 time. En eye-tracker vil overvåge deltagerens blikaktiviteter og pupilstørrelse. En funktionel nær-infrarød spektroskopi (fNIRS) vil overvåge deltagerens hjerneaktiviteter i frontallappen. Under eksperimentet vil deltagerne blive bedt om at:

  1. Læs læringsmateriale om analytiske skriveteknikker.
  2. Baseret på de tidligere leverede materialer, udfør en analytisk skriveopgave, der vil tage cirka 30 minutter enten med eller uden hjælp fra ChatGPT.
  3. Besvar undersøgelsesspørgsmål om deres erfaring med skriveopgaven, holdninger til brug af ChatGPT og demografiske baggrunde.

Studieoversigt

Status

Afsluttet

Intervention / Behandling

Undersøgelsestype

Interventionel

Tilmelding (Faktiske)

160

Fase

  • Ikke anvendelig

Kontakter og lokationer

Dette afsnit indeholder kontaktoplysninger for dem, der udfører undersøgelsen, og oplysninger om, hvor denne undersøgelse udføres.

Studiesteder

      • Heidelberg, Tyskland
        • Core Facility for Neuroscience of Self-Regulation, Heidelberg University

Deltagelseskriterier

Forskere leder efter personer, der passer til en bestemt beskrivelse, kaldet berettigelseskriterier. Nogle eksempler på disse kriterier er en persons generelle helbredstilstand eller tidligere behandlinger.

Berettigelseskriterier

Aldre berettiget til at studere

  • Voksen

Tager imod sunde frivillige

Ja

Beskrivelse

Inklusionskriterier:

  • Fuldtids universitetsstuderende.
  • Kan læse og skrive på engelsk.
  • Brug computeren de fleste dage i ugen.
  • Har ikke taget, eller forbereder sig i øjeblikket til, Graduate Record Examinations (GRE).
  • Brug ikke briller (kontaktlinser er tilladt).
  • Har ingen øjenskade.
  • Tager ikke i øjeblikket opioider, adrenalin eller antihypertensiva.
  • Under eksperimentet, ikke bære nogen makeup omkring øjnene.

Studieplan

Dette afsnit indeholder detaljer om studieplanen, herunder hvordan undersøgelsen er designet, og hvad undersøgelsen måler.

Hvordan er undersøgelsen tilrettelagt?

Design detaljer

  • Primært formål: Andet
  • Tildeling: Randomiseret
  • Interventionel model: Parallel tildeling
  • Maskning: Enkelt

Våben og indgreb

Deltagergruppe / Arm
Intervention / Behandling
Eksperimentel: Interventionsarm
I interventionsarmen instrueres deltagerne i at bruge ChatGPT som assistance til at udføre en analytisk skriveopgave.
Computergrænsefladen, der bruges til opgaveskrivningen, følger et opdelt skærmdesign. Skriveinstruktionerne og tekstindtastningsfeltet administreres på en undersøgelsesplatform, placeret i venstre halvdel af skærmen. ChatGPT er placeret på højre halvdel af skærmen for teknisk assistance.
Ingen indgriben: Kontrolarm
I kontrolarmen instrueres deltagerne i at udføre en analytisk skriveopgave selvstændigt uden adgang til nogen som helst teknologisk assistance.

Hvad måler undersøgelsen?

Primære resultatmål

Resultatmål
Foranstaltningsbeskrivelse
Tidsramme
Skrivepræstation
Tidsramme: 1,5 time
Essayskriveopgaven er afledt af Analytical Writing-sektionen i Graduate Record Examinations (GRE), som er en verdensomspændende og standardiseret computerbaseret eksamen udviklet af Educational Testing Service (ETS). Deltagernes essays vil blive bedømt på en skala fra 0 til 6 af et automatisk og valideret tredjepartsscoringsværktøj, som også er udviklet af ETS.
1,5 time
Kognitiv indsats målt efter elevstørrelse
Tidsramme: 1,5 time
Kognitiv indsats kvantificeres ved at overvåge ændringer i pupilstørrelse. For at opnå dette registreres pupildiametre under hele skriveopgaven ved hjælp af en nær-infrarød eyetracker, specifikt Tobii Pro Fusion-modellen. Ved starten af ​​eksperimentet måles individuelle baseline-pupildiametre under en 30-sekunders afspændingsopgave.
1,5 time

Sekundære resultatmål

Resultatmål
Foranstaltningsbeskrivelse
Tidsramme
Selvopfattelse af skrivepræstation
Tidsramme: 1,5 time

Dette er en skala med ét punkt:

Ved at bruge den samme karakterrubrik fra før, hvilken karakter mener du, at dit essay skal få (0 er det laveste og 6 er det højeste)?

Scoren går fra 0 til 6. En højere score indikerer højere selvopfattet skrivepræstation. Variablen behandles som en kontinuert variabel.

1,5 time
Selvopfattelse af kognitiv indsats
Tidsramme: 1,5 time

Dette er en Likert-skala med ét element tilpasset fra National Aeronautics and Space Administration-task load index (NASA-TLX; Hart, 2006; Hart & Staveland, 1988):

Vurder på en skala fra 1 til 7, hvor hårdt du skal arbejde for at opnå dit præstationsniveau.

Likert-scoren varierer fra 1 til 7 (1 er "meget lav" og 7 er "meget høj"). En højere score indikerer højere selvopfattet kognitiv indsats. Variablen behandles som en kontinuert variabel.

Referencer:

  1. Hart, S. G. (2006). Nasa-Task Load Index (NASA-TLX); 20 år senere. Proceedings of the Human Factors and Ergonomics Society Årsmøde. https://doi.org/10.1177/154193120605000909
  2. Hart, S. G., & Staveland, L. E. (1988). Udvikling af NASA-TLX (Task Load Index): Resultater af empirisk og teoretisk forskning. In Advances in Psychology (Vol. 52, s. 139-183). Nord-Holland.
1,5 time
Kognitiv indsats målt ved kortikal hæmodynamisk aktivitet i frontallappen
Tidsramme: 1,5 time
Kognitiv indsats kvantificeres ved at overvåge ændringer i den kortikale hæmodynamiske aktivitet i frontallappen. For at opnå dette registreres hjerneaktiviteten gennem hele skriveopgaven ved hjælp af en funktionel nær-infrarød spektroskopi (fNIRS), specifikt NIRSport2-modellen.
1,5 time
Selvopfattelse af stress
Tidsramme: 1,5 time

Dette er en et-element Likert-underskala tilpasset fra Primary Appraisal Secondary Appraisal-skalaen (PASA; Gaab, 2009; Pollak et al., 2020):

Hvor enig eller uenig ville du på en skala fra 1 til 7 i følgende udsagn om oplevet stress: Den analytiske skriveopgave var stressende for mig.

Likert-scoren går fra 1 til 7 (1 er "meget uenig" og 7 er "meget enig"). En højere score indikerer højere selvopfattet stress. Variablen behandles som en kontinuert variabel.

Referencer:

  1. Gaab, J. (2009). PASA-Primær vurdering Sekundær vurdering. Et spørgeskema til vurdering af kognitive vurderinger af situationer. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B., & Kozusznik, M. W. (2020). Stress i manuelle og autonome samarbejdsformer med en cobot. Computere i menneskelig adfærd, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 time
Selvopfattelse af udfordring
Tidsramme: 1,5 time

Dette er en et-element Likert-underskala tilpasset fra Primary Appraisal Secondary Appraisal-skalaen (PASA; Gaab, 2009; Pollak et al., 2020):

Hvor enig eller uenig er du på en skala fra 1 til 7 i følgende udsagn om oplevet udfordring: Jeg synes, at den analytiske skriveopgave er en udfordring.

Likert-scoren går fra 1 til 7 (1 er "meget uenig" og 7 er "meget enig"). En højere score indikerer højere selvopfattet udfordring. Variablen behandles som en kontinuert variabel.

Referencer:

  1. Gaab, J. (2009). PASA-Primær vurdering Sekundær vurdering. Et spørgeskema til vurdering af kognitive vurderinger af situationer. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, M. M., Kozusznik, B., & Kozusznik, M. W. (2020). Stress i manuelle og autonome samarbejdsformer med en cobot. Computere i menneskelig adfærd, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 time
Selveffektivitet i at skrive
Tidsramme: 1,5 time

Dette er en Likert-skala med 16 elementer, der måler tre dimensioner af selv-effektivitet ved at skrive: idé, konvention og selvregulering (Bruning et al., 2013). Likert-scoren går fra 1 til 7 (1 er "meget uenig" og 7 er "meget enig"). En højere score indikerer højere self-efficacy. De tre dimensioner vil blive behandlet separat, hver som en kontinuerlig variabel.

Reference:

1. Bruning, R., Dempsey, M., Kauffman, D. F., McKim, C., & Zumbrunn, S. (2013). Undersøgelse af dimensioner af self-efficacy til skrivning. Journal of Educational Psychology, 105(1), 25.

1,5 time
Situationsbestemt interesse for analytisk skrivning
Tidsramme: 1,5 time

Dette er en Likert-skala med fire elementer tilpasset fra den situationelle interesseskala (Hulleman et al., 2010). Denne skala måler deltagernes situationelle interesse for analytisk skrivning:

Hvor enig eller uenig ville du på en skala fra 1 til 7 i følgende udsagn om din interesse for den analytiske skriveopgave, som du lige har gennemført?

  1. Den analytiske skriveopgave var interessant.
  2. Det var sjovt at arbejde med essayet.
  3. Jeg nød at skrive essayet.
  4. Den analytiske skriveopgave var underholdende.

Likert-scoren går fra 1 til 7 (1 er "meget uenig" og 7 er "meget enig"). En højere score indikerer højere situationsbestemt interesse. Variablen behandles som en kontinuert variabel.

Reference:

1. Hulleman, C. S., Godes, O., Hendricks, B. L., & Harackiewicz, J. M. (2010). Forbedring af interesse og ydeevne med et nytteværdiindgreb. Journal of Educational Psychology, 102(4), 880.

1,5 time
Adfærdsmæssig hensigt ved brug af ChatGPT
Tidsramme: 1,5 time

Dette er en Likert-skala med to elementer, der måler deltagernes adfærdsmæssige intention med at bruge ChatGPT i fremtiden til essayskrivningsopgaver (Albayati, 2024):

På en skala fra 1 til 7, hvor er du enig eller uenig i følgende udsagn om brug af ChatGPT i essayskrivningsopgaver?

  1. Hvis jeg har adgang til ChatGPT, ville jeg bruge det til essayskrivningsopgaver.
  2. Jeg planlægger at bruge ChatGPT i fremtiden, hvis jeg har en opgaveskrivning.

Likert-scoren går fra 1 til 7 (1 er "meget uenig" og 7 er "meget enig"). En højere score indikerer højere adfærdsmæssige intentioner ved brug af ChatGPT. Variablen behandles som en kontinuert variabel.

Reference:

1. Albayati, H. (2024). Undersøgelse af bachelorstuderendes opfattelse og bevidsthed om at bruge ChatGPT som et regulært hjælpeværktøj: En undersøgelse af brugeracceptperspektiv. Computere og uddannelse: Kunstig intelligens, 6, 100203. https://doi.org/10.1016/j.caeai.2024.100203

1,5 time

Samarbejdspartnere og efterforskere

Det er her, du vil finde personer og organisationer, der er involveret i denne undersøgelse.

Efterforskere

  • Ledende efterforsker: Till Bärnighausen, Heidelberg Institute of Global Health

Datoer for undersøgelser

Disse datoer sporer fremskridtene for indsendelser af undersøgelsesrekord og resumeresultater til ClinicalTrials.gov. Studieregistreringer og rapporterede resultater gennemgås af National Library of Medicine (NLM) for at sikre, at de opfylder specifikke kvalitetskontrolstandarder, før de offentliggøres på den offentlige hjemmeside.

Studer store datoer

Studiestart (Faktiske)

18. juli 2024

Primær færdiggørelse (Faktiske)

20. februar 2025

Studieafslutning (Faktiske)

20. februar 2025

Datoer for studieregistrering

Først indsendt

15. juli 2024

Først indsendt, der opfyldte QC-kriterier

15. juli 2024

Først opslået (Faktiske)

19. juli 2024

Opdateringer af undersøgelsesjournaler

Sidste opdatering sendt (Faktiske)

9. juli 2025

Sidste opdatering indsendt, der opfyldte kvalitetskontrolkriterier

4. juli 2025

Sidst verificeret

1. juli 2025

Mere information

Begreber relateret til denne undersøgelse

Andre undersøgelses-id-numre

  • S-117/2024

Lægemiddel- og udstyrsoplysninger, undersøgelsesdokumenter

Studerer et amerikansk FDA-reguleret lægemiddelprodukt

Ingen

Studerer et amerikansk FDA-reguleret enhedsprodukt

Ingen

produkt fremstillet i og eksporteret fra U.S.A.

Ingen

Disse oplysninger blev hentet direkte fra webstedet clinicaltrials.gov uden ændringer. Hvis du har nogen anmodninger om at ændre, fjerne eller opdatere dine undersøgelsesoplysninger, bedes du kontakte register@clinicaltrials.gov. Så snart en ændring er implementeret på clinicaltrials.gov, vil denne også blive opdateret automatisk på vores hjemmeside .

Abonner