{"id":"W2057049040","doi":"10.1046/j.1365-2923.2003.01403.x","title":"The rating of pre‐clerkship examination questions by postgraduate medical students: an assessment of quality and relevancy to medical practice","year":2003,"lang":"en","type":"article","venue":"Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":17,"is_retracted":false,"has_abstract":true,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Medical education; Curriculum; Objective structured clinical examination; United States Medical Licensing Examination; Psychology; Final examination; Relevance (law); Quality (philosophy); Rating scale; Troubleshooting; Educational measurement; Medicine; Family medicine; Medical school; Pedagogy; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01875488,0.0001826654,0.0003821726,0.0001760185,0.0002333072,0.00003904622,0.0004418714,0.0003675215,0.0005220484],"category_scores_gemma":[0.2602,0.0001393601,0.00004454381,0.0008601459,0.000514079,0.0002614797,0.00008362322,0.0008096028,0.00000351845],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002356145,"about_ca_system_score_gemma":0.006598273,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0003024162,"about_ca_topic_score_gemma":0.00005227618,"domain_scores_codex":[0.9901527,0.001592676,0.001534236,0.0004211886,0.006000651,0.0002985418],"domain_scores_gemma":[0.9939806,0.001977418,0.0006924394,0.0007103152,0.001878207,0.0007610021],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0001268826,0.009702341,0.03320001,0.0005651271,0.0001562621,0.000004212391,0.003490428,0.000001300712,0.0006158716,0.07011703,0.03085108,0.8511695],"study_design_scores_gemma":[0.003709674,0.001924528,0.8931014,0.00345773,0.0003839094,0.000373938,0.01306062,0.004030704,0.001026034,0.001877534,0.0765018,0.0005521539],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8426156,0.0004949506,0.01116088,0.1416949,0.00115572,0.0009382032,0.000003631186,0.00004353428,0.001892536],"genre_scores_gemma":[0.9709947,0.0004921181,0.01059158,0.01702233,0.0002445881,0.0002239103,0.0001485294,0.00002704575,0.0002551652],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8599014,"threshold_uncertainty_score":0.9990334,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02698928462744771,"score_gpt":0.5127113489412384,"score_spread":0.4857220643137907,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}