{"id":"W1986967177","doi":"10.3109/0142159x.2010.486063","title":"Assessment steers learning down the right road: Impact of progress testing on licensing examination performance","year":2010,"lang":"en","type":"article","venue":"Medical Teacher","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":121,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; McMaster University","funders":"","keywords":"Formative assessment; Test (biology); Curriculum; Psychology; Medicine; Medical education; Mathematics education; Pedagogy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007991611,0.0004973412,0.0005831275,0.0005487091,0.000367403,0.0008742223,0.0005972525,0.0006704116,0.002911099],"category_scores_gemma":[0.07465793,0.0001874119,0.0005346778,0.0003550385,0.0005483759,0.0008385214,0.001174903,0.001257822,0.0005460425],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005115114,"about_ca_system_score_gemma":0.00132378,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002248702,"about_ca_topic_score_gemma":0.002345902,"domain_scores_codex":[0.9869612,0.008533501,0.0004337691,0.0004776058,0.003132275,0.0004615418],"domain_scores_gemma":[0.9398135,0.04391813,0.006395129,0.001958564,0.002591866,0.005322757],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.01251943,0.01483534,0.1348195,0.00043973,0.0002945124,0.000347228,0.001473943,0.004221201,0.007969149,0.0003753449,0.002780956,0.8199238],"study_design_scores_gemma":[0.0007951513,0.07349762,0.9048786,0.0002487183,0.0002998528,0.000510987,0.0009529607,0.005608432,0.009147123,0.000582253,0.003382654,0.00009567889],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9915259,0.0007314097,0.0009144827,0.0009649775,0.0001038219,0.00009139469,0.00004461602,0.0001641151,0.005459228],"genre_scores_gemma":[0.99777,0.0001937752,0.0008546276,0.00006814484,0.0000358567,0.00002070917,0.00003115403,0.00001228209,0.001013618],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.007991611,"threshold_uncertainty_score":0.04226416,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02780155950402934,"score_gpt":0.3811736229013911,"score_spread":0.3533720633973618,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}