{"id":"W4391566127","doi":"10.5334/pme.956","title":"Design and Implementation of a National Program of Assessment Model – Integrating Entrustable Professional Activity Assessments in Canadian Specialist Postgraduate Medical Education","year":2024,"lang":"en","type":"article","venue":"Perspectives on Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University Health Centre; Queen's University; Royal College of Physicians and Surgeons of Canada; University of Ottawa","funders":"","keywords":"Summative assessment; Competence (human resources); Formative assessment; Coaching; Medical education; Transformative learning; Educational assessment; Computer science; Psychology; Medicine; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02189052,0.0005327521,0.000363399,0.00108587,0.003074697,0.002336498,0.002271624,0.0008097528,0.002760228],"category_scores_gemma":[0.01774443,0.0004928696,0.0006764199,0.001088246,0.001411817,0.0009748822,0.002420149,0.001047209,0.000412687],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.04765508,"about_ca_system_score_gemma":0.1550374,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.4940819,"about_ca_topic_score_gemma":0.6444426,"domain_scores_codex":[0.9814388,0.009888334,0.0008164967,0.001857864,0.003761742,0.002236684],"domain_scores_gemma":[0.9847075,0.002417958,0.001132325,0.0009157746,0.007549868,0.003276592],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.004499621,0.01015524,0.08902752,0.001851127,0.0002105884,0.0003383837,0.01389261,0.04449907,0.01514348,0.02568107,0.01544299,0.7792583],"study_design_scores_gemma":[0.005720379,0.03201208,0.3486399,0.001546437,0.001026261,0.0003289963,0.02716818,0.1721154,0.03725674,0.01268425,0.3606612,0.0008401452],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.589269,0.0005251365,0.1712987,0.004803124,0.0003607326,0.1800009,0.002288467,0.00173295,0.04972108],"genre_scores_gemma":[0.4625126,0.000259627,0.467022,0.0008866171,0.00002486756,0.06094582,0.0009487953,0.00006611425,0.007333681],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9523449,"threshold_uncertainty_score":0.982412,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02561477575250796,"score_gpt":0.4870729356762655,"score_spread":0.4614581599237575,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}