{"id":"W1486190448","doi":"10.1111/medu.12091","title":"Rethinking programme evaluation in health professions education: beyond ‘did it work?’","year":2013,"lang":"en","type":"article","venue":"Medical Education","topic":"Evaluation and Performance Assessment","field":"Decision Sciences","cited_by":217,"is_retracted":false,"has_abstract":true,"ca_institutions":"Holland Bloorview Kids Rehabilitation Hospital; The Wilson Centre; London Health Sciences Centre; Centre Hospitalier Universitaire Sainte-Justine; SickKids Foundation; University of Toronto","funders":"","keywords":"Parallels; Context (archaeology); Engineering ethics; Curriculum; Field (mathematics); Process (computing); Work (physics); Health professions; Sociology; Program evaluation; Medical education; Management science; Health care; Psychology; Pedagogy; Political science; Medicine; Computer science; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5429921,0.001266659,0.002872804,0.006230934,0.009208282,0.02837331,0.006301356,0.008170901,0.003692309],"category_scores_gemma":[0.5337839,0.001010819,0.002435198,0.00531189,0.05284436,0.03226676,0.02065201,0.02131786,0.0007930717],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.04251753,"about_ca_system_score_gemma":0.09339535,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009917916,"about_ca_topic_score_gemma":0.01253901,"domain_scores_codex":[0.3935691,0.5407359,0.01345978,0.006453588,0.04057721,0.005204373],"domain_scores_gemma":[0.3076421,0.5908211,0.01778524,0.02487192,0.04830369,0.01057588],"domain_codex":"methods","domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002737681,0.0005069746,0.005151607,0.01174095,0.000261775,0.0002024974,0.09348112,0.002380927,0.0004745217,0.2836366,0.02019325,0.581696],"study_design_scores_gemma":[0.0004093297,0.001608245,0.01184293,0.08450728,0.0005028799,0.000486886,0.092544,0.005573271,0.003574255,0.4341466,0.3643656,0.0004386651],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"empirical","genre_scores_codex":[0.03842368,0.05759956,0.2464239,0.5791609,0.01086378,0.004833442,0.0002236151,0.0005671109,0.061904],"genre_scores_gemma":[0.703957,0.02316004,0.1981577,0.06071204,0.002333903,0.006739933,0.0001415306,0.0005212358,0.004276526],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.4570079,"threshold_uncertainty_score":0.5635722,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2344919811446988,"score_gpt":0.5649593503657884,"score_spread":0.3304673692210895,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}