{"id":"W4411021933","doi":"10.5770/cgj.28.795","title":"Validity and Utility of the CanMEDS “Resident as Teacher Multisource Feedback” Assessment Tool for Resident-led Structured Teaching","year":2025,"lang":"en","type":"article","venue":"Canadian Geriatrics Journal","topic":"Innovations in Medical Education","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"University of Toronto","keywords":"Inter-rater reliability; Narrative; Medicine; Cronbach's alpha; Medical education; Consistency (knowledge bases); Thematic analysis; Summative assessment; Psychology; Formative assessment; Pedagogy; Qualitative research; Rating scale; Clinical psychology; Psychometrics; Computer science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07278233,0.0005140831,0.0006535448,0.003099454,0.0006740495,0.001378682,0.001246902,0.0006817813,0.0008779759],"category_scores_gemma":[0.1781877,0.0004081602,0.001438842,0.001581888,0.001157302,0.001692232,0.002137076,0.0008128684,0.0004614009],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002231333,"about_ca_system_score_gemma":0.003323115,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003748904,"about_ca_topic_score_gemma":0.006120124,"domain_scores_codex":[0.9286204,0.03767269,0.007841775,0.003197681,0.02142286,0.001244601],"domain_scores_gemma":[0.8397686,0.08266301,0.02064693,0.008653547,0.04577776,0.00249008],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001158426,0.0009638855,0.7913138,0.0005945468,0.0003201298,0.0001470029,0.0107328,0.001851331,0.001994082,0.000447398,0.001399708,0.1890769],"study_design_scores_gemma":[0.0002676749,0.006067086,0.9484205,0.0009329452,0.0001848492,0.0004738742,0.007068983,0.02225447,0.005764971,0.0005751878,0.007812739,0.0001766315],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9855024,0.0003276363,0.008451535,0.0003446666,0.0001101007,0.0008478203,0.0003752469,0.0001240655,0.003916582],"genre_scores_gemma":[0.9830763,0.0001393183,0.01454185,0.0001151935,0.00003198229,0.00127683,0.0003227634,0.00003360492,0.0004620533],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9272177,"threshold_uncertainty_score":0.3849143,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01543480388978014,"score_gpt":0.3325171091913414,"score_spread":0.3170823053015612,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}