{"id":"W2781975634","doi":"10.1007/s40670-017-0518-x","title":"Using the NBME® Comprehensive Subject Examinations to Assess Readiness for USMLE® Step 1 and Step 2 CK: a Comparison of US/Canadian and International Medical School Students","year":2018,"lang":"en","type":"article","venue":"Medical Science Educator","topic":"Innovations in Medical Education","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":false,"ca_institutions":"","funders":"","keywords":"United States Medical Licensing Examination; Logistic regression; Medical education; Variance (accounting); Subject (documents); Medical school; Medicine; Psychology; Family medicine; Computer science; Internal medicine; Library science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001562566,0.0004070662,0.0005346073,0.002025303,0.0009230412,0.001035209,0.0007931658,0.0005852908,0.00219479],"category_scores_gemma":[0.006026883,0.0002628992,0.000794211,0.001504676,0.0003896698,0.0007869135,0.001182276,0.0009061542,0.0005977107],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001676958,"about_ca_system_score_gemma":0.00500983,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.2234714,"about_ca_topic_score_gemma":0.3542955,"domain_scores_codex":[0.9987928,0.0001166756,0.000115063,0.0001176154,0.0005180208,0.0003398472],"domain_scores_gemma":[0.9964404,0.0003662615,0.0007761079,0.00009019479,0.001429389,0.0008976724],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002458246,0.0003544058,0.9926145,0.00002403878,0.00004658958,0.00002402223,0.000740295,0.00003945155,0.0003893019,0.0000307892,0.0003175082,0.005173371],"study_design_scores_gemma":[0.000006499474,0.0002024644,0.9984108,0.00001093669,0.00001608859,0.00001714454,0.0007983344,0.00008353298,0.0001331255,0.000006962173,0.000309102,0.000004977924],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9978149,0.0001051168,0.00009231403,0.00005418541,0.00001291908,0.00006739612,0.0003129183,0.000007670019,0.001532588],"genre_scores_gemma":[0.9976497,0.0001068912,0.0002031267,0.00006309186,0.000004541387,0.00003308289,0.0006458188,0.000007235928,0.001286565],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7765287,"threshold_uncertainty_score":0.4443412,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1228355728255379,"score_gpt":0.4935361474009314,"score_spread":0.3707005745753935,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}