{"id":"W2027516927","doi":"10.1186/1472-6920-13-17","title":"Can American College of Radiology in-training examination scores be used to predict Canadian radiology licensing examination results? A retrospective study","year":2013,"lang":"en","type":"article","venue":"BMC Medical Education","topic":"Radiology practices and education","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"","keywords":"Medicine; Logistic regression; Percentile; Receiver operating characteristic; Physical examination; Test (biology); United States Medical Licensing Examination; Confidence interval; Family medicine; Internal medicine; Medical education; Statistics; Medical school","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.002689791,0.0002021651,0.0006006867,0.001037315,0.000108512,0.00001235797,0.0001712554,0.0002400082,0.0001845682],"category_scores_gemma":[0.01830219,0.0001954026,0.00004500971,0.001056164,0.0002894718,0.0001928192,0.00002313357,0.000405522,0.00001300836],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001167849,"about_ca_system_score_gemma":0.007020415,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.1086794,"about_ca_topic_score_gemma":0.2717395,"domain_scores_codex":[0.9965973,0.001120827,0.0007891331,0.0005728909,0.0004566848,0.0004631123],"domain_scores_gemma":[0.997201,0.0008002282,0.0004148851,0.0004027755,0.0004682996,0.0007127932],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000179742,0.0009944309,0.9131767,0.00005564343,0.00007119162,0.00001251911,0.03893423,0.00002406662,0.0004365879,0.0005157936,0.00634406,0.03925506],"study_design_scores_gemma":[0.00140477,0.001459225,0.9526391,0.0001347506,0.00006504226,0.0002269342,0.04244207,0.001139271,0.00002963009,0.00006572909,0.0002449077,0.0001485466],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9799136,0.00003946825,0.00009192891,0.01591414,0.0009234074,0.001982802,0.00002065953,0.00003138213,0.001082639],"genre_scores_gemma":[0.9958466,0.00002478174,0.001567979,0.001241676,0.0005193278,0.0002923734,0.0002385694,0.00002497317,0.0002437563],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1630601,"threshold_uncertainty_score":0.9986089,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04418491752810729,"score_gpt":0.3416915401400433,"score_spread":0.297506622611936,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}