MétaCan
Menu
Retour à la cohorte
Enregistrement W4417049848 · doi:10.1177/22925503251400370

The Use of Large Language Models in Postgraduate Plastic Surgery Training: A National Survey of Plastic Surgery Residents

2025· article· en· W4417049848 sur OpenAlexaffabout
Jacob Wise, Lindsay Bjornson, Chloe R. Wong, Grayson Roumeliotis

Notice bibliographique

RevuePlastic Surgery · 2025
Typearticle
Langueen
DomaineMedicine
ThématiqueArtificial Intelligence in Healthcare and Education
Établissements canadiensUniversity of TorontoUniversity of Ottawa
Organismes subventionnairesnon disponible
Mots-clésPlastic surgeryLeverage (statistics)Descriptive statisticsMEDLINEInterviewEnglish language

Résumé

récupéré en direct d'OpenAlex

Introduction: Large language models (LLMs) like ChatGPT are used by medical trainees and professionals for learning and clinical support. This study determined how Canadian plastic surgery residents utilize and perceive LLMs for their training. Methods: A cross-sectional survey was distributed to all Canadian, English-speaking plastic surgery trainees ( N = 100). Descriptive statistics and conventional content analysis were used to describe quantitative and free-text responses, respectively. Results: A total of n = 36 responses were collected (36% response rate) from Canadian plastic surgery residents. Among residents, 83.3% reported using LLMs for any purpose, and 63.8% reported using the technology for plastic surgery education. The most frequently utilized LLMs include ChatGPT (83.3%), BingAI (11.1%), and Gemini (8.3%). More than half of residents reported using LLMs a minimum of once per week (50.1%). The most common applications included explaining concepts (58.3%), explaining procedures (33.3%), answering lecture questions (27.8%), and creating presentations (27.8%). Of respondents, 94.4% reported not having received education or training on the use of LLMs, and 37.1% reported concerns with the use of the technology for plastic surgery learning. The themes that emerged from the free-text responses were categorized into 3 groups: (1) advantages, including time-efficiency and summarization, (2) disadvantages, including concerns of inaccuracies, confidentiality, and over-reliance, and (3) recommendations, such as didactic teaching sessions and workshops. Conclusions: LLMs are commonly used by Canadian plastic surgery residents for a variety of purposes. Most residents have not been trained on the optimal use of the technology, and surgical residency programs should consider formal LLM instruction to leverage the capabilities of this tool and mitigate potential harms.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,004
score de la tête « metaresearch » (Gemma)0,205
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,328
Score d'incertitude au seuil0,896

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0040,205
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0010,000
Bibliométrie0,0010,002
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,367
Tête enseignante GPT0,414
Écart entre enseignants0,047 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations2
Publié2025
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revuePlastic SurgeryMême sujetArtificial Intelligence in Healthcare and EducationTravaux en français237 207