{"id":"W1980415962","doi":"10.1080/10401334.2013.797351","title":"Predicting Performance on the Medical Council of Canada Qualifying Exam Part II","year":2013,"lang":"en","type":"article","venue":"Teaching and Learning in Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Residency training; Medical education; United States Medical Licensing Examination; Receiver operating characteristic; Medicine; Descriptive statistics; Medical school; Family medicine; Psychology; Internal medicine; Statistics; Continuing education; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.009628767,0.0001265705,0.0002963617,0.00008877668,0.0005522663,0.000005168671,0.000114612,0.00009099294,0.0006792129],"category_scores_gemma":[0.03646926,0.00007655333,0.00001241896,0.0002294992,0.0002187985,0.00004993745,0.0000410576,0.002620913,0.000002366012],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003496642,"about_ca_system_score_gemma":0.001336858,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.1180139,"about_ca_topic_score_gemma":0.003258876,"domain_scores_codex":[0.9971957,0.0003294311,0.0005198601,0.0001938144,0.001497594,0.0002635671],"domain_scores_gemma":[0.9983985,0.000933932,0.000168497,0.0002075498,0.0001908349,0.0001006431],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00009606523,0.0002750997,0.4499,0.0007626206,0.00009190124,0.00002360013,0.05966916,0.000372915,0.0004390271,0.002328829,0.09487406,0.3911667],"study_design_scores_gemma":[0.004257314,0.002410235,0.5377192,0.01393026,0.0001055735,0.0002627447,0.05470296,0.1853283,0.00008064431,0.00009513075,0.2006767,0.0004308866],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9461396,0.000128783,0.00002678761,0.03837994,0.0003305169,0.0002038921,1.211846e-7,0.00003737338,0.014753],"genre_scores_gemma":[0.9916716,0.00003784788,0.0002177104,0.00483902,0.0004998569,0.00003159354,0.000008104781,0.00001459672,0.002679672],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3907358,"threshold_uncertainty_score":0.9996801,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04120405267776721,"score_gpt":0.2957964688399564,"score_spread":0.2545924161621892,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}