Esta página foi traduzida automaticamente e a precisão da tradução não é garantida. Por favor, consulte o versão em inglês para um texto fonte.

Impacto do uso de GPT no desempenho da redação e nas habilidades cognitivas

4 de julho de 2025 atualizado por: Simiao Chen, University Hospital Heidelberg

Um ensaio clínico randomizado sobre o impacto do uso de inteligência artificial generativa no desempenho da escrita analítica e nas habilidades cognitivas

O objetivo deste experimento de laboratório randomizado e controlado é examinar se o uso da tecnologia de inteligência artificial (IA) gerada afetará o desempenho acadêmico e as habilidades cognitivas das pessoas no contexto da escrita analítica entre estudantes universitários. As principais questões que pretende responder são:

  1. O uso da tecnologia afeta o desempenho da escrita dos alunos?
  2. O uso da tecnologia afeta o esforço cognitivo dos alunos durante o processo de escrita?

Os participantes serão atribuídos aleatoriamente a um grupo de controle, que escreve sem assistência de IA, ou a um grupo experimental, que escreve com a ajuda do ChatGPT. Os pesquisadores compararão os dois grupos para ver se o ChatGPT afeta o desempenho de escrita e o esforço cognitivo dos alunos.

Para cada participante, o experimento de laboratório não durará mais de 1,5 horas. Um rastreador ocular monitorará as atividades do olhar do participante e o tamanho da pupila. Uma espectroscopia funcional de infravermelho próximo (fNIRS) monitorará as atividades cerebrais do participante no lobo frontal. Durante o experimento, os participantes serão solicitados a:

  1. Leia materiais de aprendizagem sobre técnicas de escrita analítica.
  2. Com base nos materiais fornecidos anteriormente, conclua uma tarefa de redação analítica que levará aproximadamente 30 minutos com ou sem o auxílio do ChatGPT.
  3. Responda às perguntas da pesquisa sobre sua experiência com a tarefa de redação, atitudes sobre o uso do ChatGPT e antecedentes demográficos.

Visão geral do estudo

Status

Concluído

Intervenção / Tratamento

Tipo de estudo

Intervencional

Inscrição (Real)

160

Estágio

  • Não aplicável

Contactos e Locais

Esta seção fornece os detalhes de contato para aqueles que conduzem o estudo e informações sobre onde este estudo está sendo realizado.

Locais de estudo

      • Heidelberg, Alemanha
        • Core Facility for Neuroscience of Self-Regulation, Heidelberg University

Critérios de participação

Os pesquisadores procuram pessoas que se encaixem em uma determinada descrição, chamada de critérios de elegibilidade. Alguns exemplos desses critérios são a condição geral de saúde de uma pessoa ou tratamentos anteriores.

Critérios de elegibilidade

Idades elegíveis para estudo

  • Adulto

Aceita Voluntários Saudáveis

Sim

Descrição

Critério de inclusão:

  • Estudante universitário em período integral.
  • Capaz de ler e escrever em inglês.
  • Use o computador na maioria dos dias da semana.
  • Não fez nem está se preparando para o Graduate Record Examinations (GRE).
  • Não use óculos (lentes de contato são permitidas).
  • Não tem deficiência ocular.
  • Atualmente não está tomando opioides, epinefrina ou medicamentos anti-hipertensivos.
  • Durante o experimento, não usar maquiagem ao redor dos olhos.

Plano de estudo

Esta seção fornece detalhes do plano de estudo, incluindo como o estudo é projetado e o que o estudo está medindo.

Como o estudo é projetado?

Detalhes do projeto

  • Finalidade Principal: Outro
  • Alocação: Randomizado
  • Modelo Intervencional: Atribuição Paralela
  • Mascaramento: Solteiro

Armas e Intervenções

Grupo de Participantes / Braço
Intervenção / Tratamento
Experimental: Braço de intervenção
No braço de intervenção, os participantes são instruídos a usar o ChatGPT para obter assistência na conclusão de uma tarefa de redação analítica.
A interface do computador usada para a tarefa de redação segue um design de tela dividida. As instruções de redação e o campo de entrada de texto são administrados em uma plataforma de pesquisa, colocada na metade esquerda da tela. ChatGPT é colocado na metade direita da tela para assistência tecnológica.
Sem intervenção: Braço de controle
No braço de controle, os participantes são instruídos a completar uma tarefa de escrita analítica de forma independente, sem acesso a qualquer assistência tecnológica.

O que o estudo está medindo?

Medidas de resultados primários

Medida de resultado
Descrição da medida
Prazo
Desempenho de escrita
Prazo: 1,5 horas
A tarefa de redação é derivada da seção Escrita Analítica do Graduate Record Examinations (GRE), que é um exame mundial e padronizado baseado em computador desenvolvido pelo Educational Testing Service (ETS). As redações dos participantes serão pontuadas em uma escala de 0 a 6 por uma ferramenta de pontuação automática e validada de terceiros, também desenvolvida pela ETS.
1,5 horas
Esforço cognitivo medido pelo tamanho da pupila
Prazo: 1,5 horas
O esforço cognitivo é quantificado monitorando as mudanças no tamanho da pupila. Para conseguir isso, os diâmetros das pupilas são registrados durante a tarefa de escrita usando um rastreador ocular infravermelho próximo, especificamente o modelo Tobii Pro Fusion. No início do experimento, os diâmetros iniciais individuais das pupilas são medidos durante uma tarefa de relaxamento de 30 segundos.
1,5 horas

Medidas de resultados secundários

Medida de resultado
Descrição da medida
Prazo
Autopercepção do desempenho da escrita
Prazo: 1,5 horas

Esta é uma escala de um item:

Usando a mesma rubrica de classificação anterior, qual pontuação você acha que sua redação deveria obter (0 sendo a mais baixa e 6 a mais alta)?

A pontuação varia de 0 a 6. Uma pontuação mais alta indica melhor desempenho na escrita autopercebida. A variável é tratada como uma variável contínua.

1,5 horas
Autopercepção do esforço cognitivo
Prazo: 1,5 horas

Esta é uma escala Likert de um item adaptada do índice de carga de tarefas da National Aeronautics and Space Administration (NASA-TLX; Hart, 2006; Hart & Staveland, 1988):

Em uma escala de 1 a 7, avalie o quanto você tem que trabalhar para atingir seu nível de desempenho.

A pontuação Likert varia de 1 a 7 (sendo 1 “muito baixo” e 7 “muito alto”). Uma pontuação mais alta indica maior esforço cognitivo autopercebido. A variável é tratada como uma variável contínua.

Referências:

  1. Hart, SG (2006). Índice de Carga de Tarefas da Nasa (NASA-TLX); 20 anos depois. Anais da Reunião Anual da Sociedade de Fatores Humanos e Ergonomia. https://doi.org/10.1177/154193120605000909
  2. Hart, SG e Staveland, LE (1988). Desenvolvimento do NASA-TLX (Task Load Index): Resultados de pesquisas empíricas e teóricas. Em Avanços em Psicologia (Vol. 52, pp. 139-183). Holanda do Norte.
1,5 horas
Esforço cognitivo medido pela atividade hemodinâmica cortical no lobo frontal
Prazo: 1,5 horas
O Esforço Cognitivo é quantificado pelo monitoramento das mudanças na atividade hemodinâmica cortical no lobo frontal. Para conseguir isso, a atividade cerebral é registrada durante a tarefa de escrita usando uma espectroscopia funcional no infravermelho próximo (fNIRS), especificamente o modelo NIRSport2.
1,5 horas
Autopercepção do estresse
Prazo: 1,5 horas

Esta é uma subescala Likert de um item adaptada da escala Primary Appraisal Secondary Appraisal (PASA; Gaab, 2009; Pollak et al., 2020):

Numa escala de 1 a 7, quanto você concordaria ou discordaria da seguinte afirmação sobre estresse percebido: A tarefa de redação analítica foi estressante para mim.

A pontuação Likert varia de 1 a 7 (1 sendo “discordo totalmente” e 7 sendo “concordo totalmente”). Uma pontuação mais alta indica maior estresse autopercebido. A variável é tratada como uma variável contínua.

Referências:

  1. Gaab, J. (2009). PASA-Avaliação Primária Avaliação Secundária. Um questionário para a avaliação de avaliações cognitivas de situações. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, MM, Kozusznik, B., & Kozusznik, MW (2020). Estresse nos modos manuais e autônomos de colaboração com um cobot. Computadores no Comportamento Humano, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 horas
Autopercepção de desafio
Prazo: 1,5 horas

Esta é uma subescala Likert de um item adaptada da escala Primary Appraisal Secondary Appraisal (PASA; Gaab, 2009; Pollak et al., 2020):

Numa escala de 1 a 7, quanto você concordaria ou discordaria da seguinte afirmação sobre o desafio percebido: Considero o trabalho de redação analítica um desafio.

A pontuação Likert varia de 1 a 7 (1 sendo “discordo totalmente” e 7 sendo “concordo totalmente”). Uma pontuação mais alta indica maior desafio autopercebido. A variável é tratada como uma variável contínua.

Referências:

  1. Gaab, J. (2009). PASA-Avaliação Primária Avaliação Secundária. Um questionário para a avaliação de avaliações cognitivas de situações. Verhaltenstherapie, 19(2), 114-115.
  2. Pollak, A., Paliga, M., Pulopulos, MM, Kozusznik, B., & Kozusznik, MW (2020). Estresse nos modos manuais e autônomos de colaboração com um cobot. Computadores no Comportamento Humano, 112, 106469. https://doi.org/10.1016/j.chb.2020.106469
1,5 horas
Autoeficácia na escrita
Prazo: 1,5 horas

Esta é uma escala Likert de dezesseis itens que mede três dimensões da autoeficácia na escrita: ideação, convenção e autorregulação (Bruning et al., 2013). A pontuação Likert varia de 1 a 7 (1 sendo “discordo totalmente” e 7 sendo “concordo totalmente”). Uma pontuação mais alta indica maior autoeficácia. As três dimensões serão tratadas separadamente, cada uma como uma variável contínua.

Referência:

1. Bruning, R., Dempsey, M., Kauffman, DF, McKim, C., & Zumbrunn, S. (2013). Examinando dimensões de autoeficácia para escrever. Jornal de psicologia educacional, 105(1), 25.

1,5 horas
Interesse Situacional na Escrita Analítica
Prazo: 1,5 horas

Esta é uma escala Likert de quatro itens adaptada da escala de interesse situacional (Hulleman et al., 2010). Esta escala mede o interesse situacional dos participantes na escrita analítica:

Numa escala de 1 a 7, quanto você concordaria ou discordaria das seguintes afirmações sobre seu interesse no trabalho de redação analítica que acabou de concluir?

  1. A tarefa de redação analítica foi interessante.
  2. Trabalhar na redação foi divertido.
  3. Gostei de escrever o ensaio.
  4. A tarefa de redação analítica foi agradável.

A pontuação Likert varia de 1 a 7 (1 sendo “discordo totalmente” e 7 sendo “concordo totalmente”). Uma pontuação mais alta indica maior interesse situacional. A variável é tratada como uma variável contínua.

Referência:

1. Hulleman, CS, Godes, O., Hendricks, BL e Harackiewicz, JM (2010). Aumentar o interesse e o desempenho com uma intervenção de valor utilitário. Revista de Psicologia Educacional, 102(4), 880.

1,5 horas
Intenção comportamental ao usar ChatGPT
Prazo: 1,5 horas

Esta é uma escala Likert de dois itens que mede a intenção comportamental dos participantes em usar o ChatGPT no futuro para tarefas de redação (Albayati, 2024):

Em uma escala de 1 a 7, quanto você concorda ou discorda das seguintes afirmações sobre o uso do ChatGPT em trabalhos de redação?

  1. Se eu tiver acesso ao ChatGPT, eu o usaria para tarefas de redação.
  2. Pretendo usar o ChatGPT no futuro se tiver uma tarefa de redação.

A pontuação Likert varia de 1 a 7 (1 sendo “discordo totalmente” e 7 sendo “concordo totalmente”). Uma pontuação mais alta indica maior intenção comportamental ao usar o ChatGPT. A variável é tratada como uma variável contínua.

Referência:

1. Albayati, H. (2024). Investigando a percepção e a consciência de estudantes de graduação sobre o uso do ChatGPT como ferramenta de atendimento regular: um estudo da perspectiva de aceitação do usuário. Computadores e Educação: Inteligência Artificial, 6, 100203. https://doi.org/10.1016/j.caeai.2024.100203

1,5 horas

Colaboradores e Investigadores

É aqui que você encontrará pessoas e organizações envolvidas com este estudo.

Investigadores

  • Investigador principal: Till Bärnighausen, Heidelberg Institute of Global Health

Datas de registro do estudo

Essas datas acompanham o progresso do registro do estudo e os envios de resumo dos resultados para ClinicalTrials.gov. Os registros do estudo e os resultados relatados são revisados ​​pela National Library of Medicine (NLM) para garantir que atendam aos padrões específicos de controle de qualidade antes de serem publicados no site público.

Datas Principais do Estudo

Início do estudo (Real)

18 de julho de 2024

Conclusão Primária (Real)

20 de fevereiro de 2025

Conclusão do estudo (Real)

20 de fevereiro de 2025

Datas de inscrição no estudo

Enviado pela primeira vez

15 de julho de 2024

Enviado pela primeira vez que atendeu aos critérios de CQ

15 de julho de 2024

Primeira postagem (Real)

19 de julho de 2024

Atualizações de registro de estudo

Última Atualização Postada (Real)

9 de julho de 2025

Última atualização enviada que atendeu aos critérios de controle de qualidade

4 de julho de 2025

Última verificação

1 de julho de 2025

Mais Informações

Termos relacionados a este estudo

Outros números de identificação do estudo

  • S-117/2024

Informações sobre medicamentos e dispositivos, documentos de estudo

Estuda um medicamento regulamentado pela FDA dos EUA

Não

Estuda um produto de dispositivo regulamentado pela FDA dos EUA

Não

produto fabricado e exportado dos EUA

Não

Essas informações foram obtidas diretamente do site clinicaltrials.gov sem nenhuma alteração. Se você tiver alguma solicitação para alterar, remover ou atualizar os detalhes do seu estudo, entre em contato com register@clinicaltrials.gov. Assim que uma alteração for implementada em clinicaltrials.gov, ela também será atualizada automaticamente em nosso site .

Se inscrever