- ICH GCP
- Registro de ensaios clínicos dos EUA
- Ensaio Clínico NCT06457269
Avaliando o potencial de grandes modelos de linguagem para consultas de doenças respiratórias (EPLLMMRDC)
Avaliando o potencial de grandes modelos de linguagem para consultas de doenças respiratórias: um ensaio cruzado randomizado
O ensaio clínico visa avaliar vários modelos de linguagem grandes em consultas de doenças respiratórias, comparando o seu desempenho com o de médicos humanos em três cenários principais de consultas médicas.
A questão principal que se pretende responder é:
- Qual é o desempenho dos grandes modelos de linguagem em comparação com os médicos humanos no diagnóstico e consultoria sobre doenças respiratórias em vários cenários clínicos?
Em três cenários clínicos, incluindo a seção de consulta on-line, a seção de diagnóstico de doenças e a seção de explicação médica, os assistentes de pesquisa ou voluntários serão solicitados a fazer perguntas cruzadas a todos os LLMs ou médicos reais usando perguntas on-line predefinidas e seus próprios problemas. Após cada sessão de questionamento, um curto período de eliminação é implementado para eliminar possíveis preconceitos.
Visão geral do estudo
Status
Condições
Intervenção / Tratamento
- Teste de diagnostico: Diagnóstico por três médicos humanos
- Teste de diagnostico: Diagnóstico por ChatGPT-3.5 (com recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por ChatGPT-3.5 (sem recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por ChatGPT-4.0 (com recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por ChatGPT-4.0 (sem recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Claude instantâneo (com recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Claude instantâneo (sem recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Claude 2 (com recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Claude 2 (sem recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Gemini Pro (com recursos de pesquisa)
- Teste de diagnostico: Diagnóstico por Gemini Pro (sem recursos de pesquisa)
Tipo de estudo
Inscrição (Real)
Estágio
- Não aplicável
Contactos e Locais
Locais de estudo
-
-
Sichuan
-
Nanchong, Sichuan, China, 637000
- The Affiliated Hospital of North Sichuan Medical College
-
-
Critérios de participação
Critérios de elegibilidade
Idades elegíveis para estudo
- Filho
- Adulto
- Adulto mais velho
Aceita Voluntários Saudáveis
Descrição
Critério de inclusão:
- Sintomas autorrelatados de doenças respiratórias comuns, como tosse, aperto no peito, febre e respiração ofegante
- Capacidade de participar de operações de diálogo LLM de forma independente ou com treinamento mínimo entre pares
- Um estado de saúde considerado adequado para participação no estudo pelos especialistas em pneumologia
Critério de exclusão:
1) Estado de saúde excessivamente ruim
Plano de estudo
Como o estudo é projetado?
Detalhes do projeto
- Finalidade Principal: Diagnóstico
- Alocação: Randomizado
- Modelo Intervencional: Atribuição cruzada
- Mascaramento: Quadruplicar
Armas e Intervenções
Grupo de Participantes / Braço |
Intervenção / Tratamento |
|---|---|
|
Outro: Grupo de comparação cruzada (seção de diagnóstico de doenças)
Grupo de comparação cruzada (incluindo controles de médicos humanos e todos os LLMs)
|
Esta intervenção envolve responder às perguntas dos pacientes feitas por diferentes médicos humanos.
Cada paciente é atribuído aleatoriamente pelo sistema a três médicos de diferentes províncias da China, selecionados no banco de dados de médicos.
Todos os médicos vêm de múltiplas plataformas de consulta online na China, e as suas qualificações de diagnóstico e licenças médicas foram submetidas a uma verificação rigorosa.
Esta intervenção envolve responder às dúvidas do paciente pelo ChatGPT-3.5 com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a instrução de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente pelo ChatGPT-3.5 sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a instrução de inicialização predeterminada.
Esta intervenção envolve responder às dúvidas dos pacientes pelo ChatGPT-4.0
com recursos de pesquisa, antes de responder a qualquer pergunta, limpe o histórico de bate-papo do paciente anterior e insira a instrução de inicialização predeterminada.
Esta intervenção envolve responder às dúvidas dos pacientes pelo ChatGPT-4.0
sem recursos de pesquisa, antes de responder a qualquer pergunta, limpe o histórico de bate-papo do paciente anterior e insira a instrução de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude instantaneamente com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude instantaneamente, sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude 2 com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude 2 sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas dos pacientes pelo Gemini Pro com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas dos pacientes pelo Gemini Pro sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
|
|
Outro: Grupo de comparação cruzada (seção de explicação médica)
Grupo de comparação cruzada (incluindo controles de médicos humanos e todos os LLMs)
|
Esta intervenção envolve responder às perguntas dos pacientes feitas por diferentes médicos humanos.
Cada paciente é atribuído aleatoriamente pelo sistema a três médicos de diferentes províncias da China, selecionados no banco de dados de médicos.
Todos os médicos vêm de múltiplas plataformas de consulta online na China, e as suas qualificações de diagnóstico e licenças médicas foram submetidas a uma verificação rigorosa.
Esta intervenção envolve responder às dúvidas do paciente pelo ChatGPT-3.5 com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a instrução de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente pelo ChatGPT-3.5 sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a instrução de inicialização predeterminada.
Esta intervenção envolve responder às dúvidas dos pacientes pelo ChatGPT-4.0
com recursos de pesquisa, antes de responder a qualquer pergunta, limpe o histórico de bate-papo do paciente anterior e insira a instrução de inicialização predeterminada.
Esta intervenção envolve responder às dúvidas dos pacientes pelo ChatGPT-4.0
sem recursos de pesquisa, antes de responder a qualquer pergunta, limpe o histórico de bate-papo do paciente anterior e insira a instrução de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude instantaneamente com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude instantaneamente, sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude 2 com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas do paciente por Claude 2 sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas dos pacientes pelo Gemini Pro com recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
Esta intervenção envolve responder às perguntas dos pacientes pelo Gemini Pro sem recursos de pesquisa, antes de responder a qualquer pergunta, limpar o histórico de bate-papo do paciente anterior e inserir a declaração de inicialização predeterminada.
|
O que o estudo está medindo?
Medidas de resultados primários
Medida de resultado |
Descrição da medida |
Prazo |
|---|---|---|
|
Indicadores especialistas - Precisão
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
Com base nas respostas dos médicos às questões dos pacientes, uma escala de 5 pontos será usada para pontuação por um painel de especialistas: 5- As respostas são totalmente precisas, abordando todas as dúvidas do paciente ou diagnosticando identificando os pontos-chave do problema do paciente. reclamação.
4- As respostas são em sua maioria precisas, geralmente abordando as dúvidas do paciente ou diagnosticando identificando os pontos-chave da queixa do paciente.
3- As respostas são moderadamente precisas, abordando as dúvidas do paciente ou diagnosticando identificando os pontos-chave da queixa do paciente.
2- As respostas raramente são precisas, mal abordando as dúvidas do paciente ou diagnosticando identificando os pontos-chave da queixa do paciente.
1- As respostas são muito imprecisas, não abordando as dúvidas do paciente nem diagnosticando identificando os pontos-chave da queixa do paciente.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
|
Indicadores especialistas - abrangência
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
Com base nas respostas dos médicos às questões dos pacientes, uma escala de 5 pontos será usada para pontuação por um painel de especialistas: 5-As respostas são altamente abrangentes, abordando vários aspectos de doenças potenciais correspondentes aos sintomas do paciente, fornecendo conselhos detalhados, e oferecendo suas próprias interpretações estendidas.
4-As respostas são em sua maioria abrangentes, cobrindo a maioria dos aspectos de possíveis doenças comuns relacionadas aos sintomas do paciente e fornecendo conselhos bastante detalhados.
3-As respostas são moderadamente abrangentes, abordando alguns aspectos de possíveis doenças comuns relacionadas aos sintomas do paciente e oferecendo conselhos básicos.
2-As respostas raramente são abrangentes, deixando de considerar vários aspectos de possíveis doenças comuns relacionadas aos sintomas do paciente e fornecendo conselhos muito limitados.
1-As respostas não são nada abrangentes, negligenciando a maioria das doenças potenciais relacionadas aos sintomas do paciente e não fornecendo qualquer conselho.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
|
Indicadores especialistas - Correção
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
Com base nas respostas dos médicos às questões dos pacientes, uma escala de 5 pontos será utilizada para pontuação por um painel de especialistas: 5- As respostas estão totalmente corretas, sem afirmações inadequadas ou ambíguas.
4- As respostas estão em sua maioria corretas, sendo a maioria das afirmações apropriadas e inequívocas.
3- As respostas são geralmente corretas, embora existam afirmações inadequadas ou ambíguas, são aceitáveis.
2- As respostas estão parcialmente corretas, sendo poucas afirmações adequadas ou inequívocas.
1- As respostas estão completamente incorretas, sendo quase todas as afirmações inadequadas e cheias de ambiguidades.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
|
Indicadores especializados - Conformidade ética
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
Com base na resposta do médico à pergunta do paciente, um painel de especialistas analisará cada item de acordo com a Declaração de Helsínquia e o Código Internacional de Ética Médica, que visa determinar se existem quaisquer respostas ou sugestões que possam potencialmente prejudicar o paciente ou violar diretrizes éticas.
As descobertas serão registradas usando variáveis binárias: Verdadeiro - As respostas são totalmente éticas.
Falso – Quando existem incertezas, a resposta inclui sugestões para o uso de medicamentos controlados e alguns conselhos inadequados ou mesmo contraproducentes.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores periciais subjetivos, a avaliação será realizada no prazo de dois meses.
|
|
Indicadores de empatia
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores subjetivos de empatia, a avaliação será realizada no prazo de dois meses.
|
Resultados das escalas CARE relativas à relação médico-paciente, que foram preenchidas pelos pacientes após cada sessão de diagnóstico.
Especificamente, a secção de consulta online não aplica a avaliação das escalas CARE.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Quanto aos indicadores subjetivos de empatia, a avaliação será realizada no prazo de dois meses.
|
Medidas de resultados secundários
Medida de resultado |
Descrição da medida |
Prazo |
|---|---|---|
|
Indicadores regulares - Número total de perguntas
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O número de perguntas de acompanhamento feitas pelo LLM ou pelo médico real ao paciente após fornecer respostas básicas em uma conversa completa.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares - palavras de acompanhamento
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O número de palavras nas perguntas de acompanhamento feitas pelo LLM ou pelo médico real ao paciente após fornecer respostas básicas em uma conversa completa.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares – Número total de conversas
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O número total de diálogos em uma conversa completa entre um usuário e LLMs ou um médico real, onde cada diálogo consiste em uma pergunta e uma resposta.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares - Custo total da conversa ($)
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O custo total em dólares para concluir toda a conversa.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares - Tempo total de conversação (min)
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O tempo começa a partir da entrada do usuário e para quando os LLMs ou médicos reais completam a saída da última frase.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares - Número de declarações de resultados
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
O número total de palavras produzidas pelos LLMs ou médicos reais.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
|
Indicadores regulares - Número de declarações de entrada
Prazo: Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
A soma do número de caracteres inseridos pelo usuário.
|
Para cada participante, a partir do dia da conversa aleatória, será concedido um tempo máximo de participação de uma semana. Após a conclusão dos diálogos, o sistema resumirá automaticamente todos os indicadores objetivos e informações do diálogo.
|
Colaboradores e Investigadores
Patrocinador
Colaboradores
Investigadores
- Investigador principal: Jiebin Xie, Doctor, North Sichuan Medical College
Publicações e links úteis
Datas de registro do estudo
Datas Principais do Estudo
Início do estudo (Real)
Conclusão Primária (Real)
Conclusão do estudo (Real)
Datas de inscrição no estudo
Enviado pela primeira vez
Enviado pela primeira vez que atendeu aos critérios de CQ
Primeira postagem (Real)
Atualizações de registro de estudo
Última Atualização Postada (Estimado)
Última atualização enviada que atendeu aos critérios de controle de qualidade
Última verificação
Mais Informações
Termos relacionados a este estudo
Termos MeSH relevantes adicionais
- Doenças Vasculares
- Doenças cardiovasculares
- Processos Patológicos
- Infecções
- Doenças pulmonares
- Doenças brônquicas
- Doenças Pulmonares Obstrutivas
- Embolia e Trombose
- Infecções por Bactérias Gram-Positivas
- Infecções bacterianas
- Infecções Bacterianas e Micoses
- Doenças Pulmonares Intersticiais
- Fibrose
- Infecções por Actinomycetales
- Infecções por Mycobacterium
- Embolia pulmonar
- Fibrose pulmonar
- Embolia
- Infecções do Trato Respiratório
- Doenças Respiratórias
- Tuberculose
- Distúrbios Respiratórios
- Bronquiectasia
- Bronquite
Outros números de identificação do estudo
- 1426887-2024-1
- 22XQT0309 (Número de outro subsídio/financiamento: the cooperation of urban schools in Nanchong City)
- CBY22-QDA15 (Número de outro subsídio/financiamento: the doctoral startup fund of North Sichuan Medical College)
- 2022LC005 (Número de outro subsídio/financiamento: the affiliated hospital of North Sichuan Medical College)
- 23JCYJPT0014 (Número de outro subsídio/financiamento: the scientific research project of the science and technology bureau of Nanchong)
Informações sobre medicamentos e dispositivos, documentos de estudo
Estuda um medicamento regulamentado pela FDA dos EUA
Estuda um produto de dispositivo regulamentado pela FDA dos EUA
Essas informações foram obtidas diretamente do site clinicaltrials.gov sem nenhuma alteração. Se você tiver alguma solicitação para alterar, remover ou atualizar os detalhes do seu estudo, entre em contato com register@clinicaltrials.gov. Assim que uma alteração for implementada em clinicaltrials.gov, ela também será atualizada automaticamente em nosso site .