Denne siden ble automatisk oversatt og nøyaktigheten av oversettelsen er ikke garantert. Vennligst referer til engelsk versjon for en kildetekst.

Evaluering av beslutninger ved hjelp av chatgpt-4 blant traineer i operasjonen (EDuCATe)

8. april 2025 oppdatert av: Manuela Mastronardi, Ospedali Riuniti Trieste

Evaluering av chatgpt-4 som et beslutningsstøtteverktøy for kirurgiske traineer

Denne studien tar sikte på å vurdere om ChatGPT-4 kan støtte kirurgiske traineer i klinisk beslutningstaking. Ved å sammenligne ytelsen til CHATGPT-4 med juniorbeboere, eldre innbyggere og delta på kirurger på standardiserte kliniske scenarier, søker studien å forstå den potensielle rollen til store språkmodeller i kirurgisk utdanning. Det endelige målet er å evaluere om ChatGPT-4 trygt kan integreres som et supplerende pedagogisk verktøy for å hjelpe juniorbeboere i å utvikle kritisk tenking og kirurgisk skjønn.

Studieoversikt

Status

Har ikke rekruttert ennå

Intervensjon / Behandling

Detaljert beskrivelse

Bakgrunn:

Kunstig intelligens (AI) transformerer raskt det medisinske landskapet, og tilbyr nye muligheter innen utdanning, diagnostikk og beslutningsstøtte. I kirurgi er klinisk beslutningstaking en kjernekompetanse utviklet gradvis gjennom trening. ChatGPT-4, en topp moderne stor språkmodell utviklet av Openai, har vist kompetanse i håndtering av medisinske spørsmål og kliniske resonneringsoppgaver. Imidlertid er ytelsen i komplekse kirurgiske beslutninger sammenlignet med menneskelige traineer stort sett uutforsket.

Objektiv:

The Educate Study tar sikte på å evaluere nøyaktigheten og påliteligheten av ChatGPT-4s svar på kliniske scenarier som involverer generelle kirurgiske tilfeller. Spesifikt sammenligner studien modellens ytelse med den fra Junior-innbyggerne, eldre innbyggere og å delta på kirurger for å forstå om ChatGPT-4 kan tjene som et trygt og effektivt pedagogisk verktøy for kirurgiske praktikanter.

Metoder:

Syv kliniske scenarier vil bli konstruert ved hjelp av ekte anonymiserte pasientdata som representerer vanlige kirurgiske forhold. Hver sak vil bli presentert trinn for trinn, og etterligner den kliniske beslutningsprosessen. Deltakerne vil svare på et spørsmål relatert til valg av behandling.

Deltakerne vil inkludere juniorbeboere (PGY1-2), seniorboere (PGY3+) og delta på kirurger fra en enkelt kirurgisk avdeling. ChatGPT-4 vil bli bedt om med de samme scenariene. Alle deltakerne vil bli instruert om å fullføre sakene uten å bruke eksterne ressurser som AI -verktøy eller internettsøk, og utelukkende stoler på deres kliniske kunnskap.

Statistisk analyse vil sammenligne ytelse på tvers av grupper ved bruk av ikke-parametriske tester (f.eks. Wilcoxon rangsum).

Forventede utfall:

Studien antar at ChatGPT-4 vil prestere på et nivå som kan sammenlignes med eldre innbyggere eller delta på kirurger og overgå juniorbeboere i beslutninger. Hvis bekreftet, kan disse resultatene støtte sikker bruk av ChatGPT-4 som et treningshjelp for junior kirurgiske innbyggere, og potensielt forbedre utdanningsresultater og kliniske resonnementferdigheter.

Betydning:

Denne studien vil gi ny innsikt i rollen som AI i kirurgisk utdanning. Ved å sammenligne CHATGPT-4s beslutningsevner for menneskelige kirurger på forskjellige nivåer, håper studien å definere dens nytte, begrensninger og passende bruk i forskjellige nivåer.

Studietype

Observasjonsmessig

Registrering (Antatt)

35

Kontakter og plasseringer

Denne delen inneholder kontaktinformasjon for de som utfører studien, og informasjon om hvor denne studien blir utført.

Studiekontakt

Studiesteder

      • Trieste, Italia
        • University of Trieste
        • Ta kontakt med:
        • Hovedetterforsker:
          • Silvia Palmisano
        • Hovedetterforsker:
          • Manuela Mastronardi
        • Underetterforsker:
          • Paola Germani
        • Underetterforsker:
          • Margherita Sandano

Deltakelseskriterier

Forskere ser etter personer som passer til en bestemt beskrivelse, kalt kvalifikasjonskriterier. Noen eksempler på disse kriteriene er en persons generelle helsetilstand eller tidligere behandlinger.

Kvalifikasjonskriterier

Alder som er kvalifisert for studier

  • Barn
  • Voksen
  • Eldre voksen

Tar imot friske frivillige

Nei

Prøvetakingsmetode

Ikke-sannsynlighetsprøve

Studiepopulasjon

Studiepopulasjonen vil bestå av generelle kirurgi og fakultetsmedlemmer fra en enkelt akademisk kirurgisk avdeling. Deltakerne vil bli stratifisert i tre grupper basert på deres treningsnivå og erfaring: Juniorbeboere: Postgraduate Year (PGY) 1-2; Senior innbyggere: PGY 3 og over; Deltakende kirurger: Styresertifiserte generelle kirurger med uavhengig klinisk praksis

Beskrivelse

Inkluderingskriterier:

  • Aktivt registrert eller ansatt i det generelle operasjonsoppholdet eller avdelingen ved den deltakende institusjonen
  • Vilje til å delta og fullføre alle kliniske case -scenarier
  • Samtykke til å delta i studien

Eksklusjonskriterier:

  • Ufullstendige svar
  • Bruk av ekstern assistanse (f.eks. Internett-søk, AI-verktøy) når du svarer på scenarier, som selvrapportert i instruksjoner

Studieplan

Denne delen gir detaljer om studieplanen, inkludert hvordan studien er utformet og hva studien måler.

Hvordan er studiet utformet?

Designdetaljer

Kohorter og intervensjoner

Gruppe / Kohort
Intervensjon / Behandling
Beboere
Junior- og seniorbeboere i generell kirurgi
Syv kliniske tilfeller som må analyseres
Konsulenter
Senior generelle kirurger
Syv kliniske tilfeller som må analyseres
Chatgpt 4
Kunstig intelligenssystem
Syv kliniske tilfeller som må analyseres

Hva måler studien?

Primære resultatmål

Resultatmål
Tiltaksbeskrivelse
Tidsramme
Andel riktige svar
Tidsramme: Baseline
Binært utfall (riktig kontra feil beslutning)
Baseline

Sekundære resultatmål

Resultatmål
Tiltaksbeskrivelse
Tidsramme
Sammenligning av nøyaktighet på tvers av opplevelsesnivåer
Tidsramme: Baseline
Andel riktige svar fra gruppe: Juniorbeboere, eldre innbyggere, deltakende kirurger, chatgpt-4
Baseline
Tillitsnivå
Tidsramme: Baseline
Deltakere og chatgpt blir bedt om å vurdere hvor trygge de føler i svaret (1-5 Likert skala, der 1 betyr ingen selvsikker og 5 veldig selvsikker)
Baseline
Prosentandel av bruk av AI for evaluering av kliniske tilfeller
Tidsramme: Baseline
Deltakerne blir spurt om de bruker eller ikke chatgpt i sin kliniske aktivitet
Baseline

Samarbeidspartnere og etterforskere

Det er her du vil finne personer og organisasjoner som er involvert i denne studien.

Studierekorddatoer

Disse datoene sporer fremdriften for innsending av studieposter og sammendragsresultater til ClinicalTrials.gov. Studieposter og rapporterte resultater gjennomgås av National Library of Medicine (NLM) for å sikre at de oppfyller spesifikke kvalitetskontrollstandarder før de legges ut på det offentlige nettstedet.

Studer hoveddatoer

Studiestart (Antatt)

10. april 2025

Primær fullføring (Antatt)

25. april 2025

Studiet fullført (Antatt)

30. april 2025

Datoer for studieregistrering

Først innsendt

2. april 2025

Først innsendt som oppfylte QC-kriteriene

8. april 2025

Først lagt ut (Faktiske)

10. april 2025

Oppdateringer av studieposter

Sist oppdatering lagt ut (Faktiske)

10. april 2025

Siste oppdatering sendt inn som oppfylte QC-kriteriene

8. april 2025

Sist bekreftet

1. april 2025

Mer informasjon

Begreper knyttet til denne studien

Andre studie-ID-numre

  • AI-Surgical training

Plan for individuelle deltakerdata (IPD)

Planlegger du å dele individuelle deltakerdata (IPD)?

NEI

Legemiddel- og utstyrsinformasjon, studiedokumenter

Studerer et amerikansk FDA-regulert medikamentprodukt

Nei

Studerer et amerikansk FDA-regulert enhetsprodukt

Nei

Denne informasjonen ble hentet direkte fra nettstedet clinicaltrials.gov uten noen endringer. Hvis du har noen forespørsler om å endre, fjerne eller oppdatere studiedetaljene dine, vennligst kontakt register@clinicaltrials.gov. Så snart en endring er implementert på clinicaltrials.gov, vil denne også bli oppdatert automatisk på nettstedet vårt. .

Abonnere