{"id":"W4408842496","doi":"10.15173/mumj.v21i1.3674","title":"Integrating large language models into medical education: A commentary on opportunities, challenges, and future directions","year":2025,"lang":"en","type":"article","venue":"McMaster University Medical Journal","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Engineering ethics; Data science; Computer science; Medical education; Psychology; Medicine; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03069551,0.001139203,0.001672209,0.002683215,0.004456708,0.006912091,0.005773488,0.02981609,0.004445779],"category_scores_gemma":[0.1459271,0.0009725258,0.002535657,0.00246415,0.01637934,0.01455563,0.005566983,0.06388573,0.002713073],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01108393,"about_ca_system_score_gemma":0.01775009,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02284697,"about_ca_topic_score_gemma":0.03095641,"domain_scores_codex":[0.9714422,0.01769277,0.002660244,0.002140501,0.00520777,0.000856519],"domain_scores_gemma":[0.7379244,0.2374335,0.003123192,0.00232419,0.01582258,0.003372108],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00003966577,0.00001556549,0.00007358807,0.0007892093,0.00002004508,0.0001715192,0.002537373,0.0001435159,0.00007556212,0.01282704,0.9667696,0.0165372],"study_design_scores_gemma":[0.0000536764,0.00006003502,0.0003012882,0.006454881,0.00003986256,0.0005602773,0.002700414,0.0004554575,0.0001798074,0.01525155,0.973859,0.00008370892],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"commentary","genre_gemma":"commentary","genre_scores_codex":[0.00008610172,0.01662734,0.0003066916,0.9628547,0.01951251,0.000005802637,0.00002612984,0.00001951388,0.0005611505],"genre_scores_gemma":[0.004880251,0.01987228,0.0006792143,0.9209142,0.05189058,0.00006792414,0.00002820089,0.00009767663,0.001569762],"genre_candidate":"commentary","genre_consensus":"commentary","teacher_disagreement_score":0.03069551,"threshold_uncertainty_score":0.1623353,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09127655172895374,"score_gpt":0.3630472839520471,"score_spread":0.2717707322230933,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}