{"id":"W4410917303","doi":"10.36834/cmej.78343","title":"Assessing the impact of virtual learning on family medicine trainees’ medical knowledge using progress tests: a retrospective cohort study","year":2025,"lang":"en","type":"article","venue":"Canadian Medical Education Journal","topic":"Innovations in Medical Education","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Retrospective cohort study; Cohort; Medical knowledge; Medicine; Medical education; Family medicine; Computer science; Data science; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003280411,0.0003276059,0.0003843833,0.001140403,0.0007339616,0.000657475,0.0004359214,0.0004362666,0.001328686],"category_scores_gemma":[0.006579964,0.0003591788,0.000760496,0.0007390114,0.0004674185,0.0008879136,0.0007687741,0.0006007313,0.000336292],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006491743,"about_ca_system_score_gemma":0.0007802314,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00728974,"about_ca_topic_score_gemma":0.006492962,"domain_scores_codex":[0.9982017,0.0004575405,0.0001913215,0.000359542,0.0004973413,0.0002924012],"domain_scores_gemma":[0.9953366,0.001175479,0.001426813,0.0006012146,0.0007122231,0.000747618],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000134367,0.0001212378,0.9979057,0.000007456691,0.00003170486,0.00005797629,0.0002325978,0.00001790187,0.0001042638,0.000008308391,0.00004002075,0.001338439],"study_design_scores_gemma":[0.00001293382,0.001342537,0.9970368,0.00001200232,0.00004063609,0.000293018,0.0007605948,0.0001244771,0.0001443414,0.00001135916,0.000211425,0.000009896941],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9994953,0.00007851444,0.00009829854,0.000008492208,0.000003368294,0.00003491641,0.0001044484,0.000001997859,0.000174635],"genre_scores_gemma":[0.9994581,0.00006399691,0.0001198796,0.00001479465,0.000004191514,0.00003757741,0.0001675559,0.000002029063,0.0001319287],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00728974,"threshold_uncertainty_score":0.01734871,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02746018694232737,"score_gpt":0.4487459128880802,"score_spread":0.4212857259457528,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}