{"id":"W2150819136","doi":"10.1080/01421590802512938","title":"Assessing postgraduate trainees in Canada: Are we achieving diversity in methods?","year":2008,"lang":"en","type":"article","venue":"Medical Teacher","topic":"Innovations in Medical Education","field":"Medicine","cited_by":23,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Logbook; Accreditation; Medical education; Specialty; Medicine; Diversity (politics); Program evaluation; Family medicine; Educational measurement; Curriculum; MEDLINE; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03692921,0.0004264363,0.0005810413,0.002195757,0.004504279,0.004843561,0.002050658,0.000728673,0.001702857],"category_scores_gemma":[0.09912515,0.0004910373,0.0003635715,0.003463715,0.003588363,0.0023981,0.004841496,0.001380458,0.0002542213],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.03310054,"about_ca_system_score_gemma":0.1237318,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.8573362,"about_ca_topic_score_gemma":0.9358226,"domain_scores_codex":[0.9715801,0.0113911,0.001472748,0.001786593,0.01086239,0.002906959],"domain_scores_gemma":[0.8894044,0.02639784,0.01192962,0.003620123,0.0453261,0.02332191],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002285685,0.0001581375,0.606603,0.001481399,0.0001078372,0.0001086182,0.02462368,0.0005995418,0.0009372407,0.001142615,0.01417831,0.3498311],"study_design_scores_gemma":[0.00004861722,0.0001848473,0.9461502,0.001649899,0.00005749432,0.0001816354,0.01867743,0.001020847,0.0008807972,0.0007658573,0.03028869,0.00009352537],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8615007,0.02484657,0.0139013,0.07321665,0.0007020939,0.0007237472,0.001152771,0.0003705959,0.02358563],"genre_scores_gemma":[0.9599816,0.008155769,0.02332226,0.005977291,0.0001272417,0.0002642557,0.000347691,0.00005925012,0.001764668],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9668995,"threshold_uncertainty_score":0.2870079,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1344025216552011,"score_gpt":0.4179195934100754,"score_spread":0.2835170717548743,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}