{"id":"W2021130872","doi":"10.1097/acm.0b013e3181ed3f5c","title":"Relationship Between Performance on the NBME Comprehensive Basic Sciences Self-Assessment and USMLE Step 1 for U.S. and Canadian Medical School Students","year":2010,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":34,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Logistic regression; United States Medical Licensing Examination; Medical education; Psychology; Medical school; Regression analysis; Medicine; Demography; Statistics; Mathematics; Internal medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001294177,0.000305801,0.0002324986,0.001478997,0.0007052571,0.0007339467,0.0007207827,0.0004444901,0.00300754],"category_scores_gemma":[0.01033118,0.0001929389,0.0003540618,0.001144513,0.0004923971,0.0003001195,0.0008796905,0.0009696429,0.0003383755],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00292052,"about_ca_system_score_gemma":0.005145429,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.4962549,"about_ca_topic_score_gemma":0.5890598,"domain_scores_codex":[0.9990921,0.00009870679,0.00005954993,0.0001234824,0.0003809032,0.0002452293],"domain_scores_gemma":[0.9938871,0.0009644108,0.002031653,0.0001728726,0.001387203,0.001556764],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001513911,0.00001835033,0.9989268,0.000002127421,0.000008244706,0.000006400661,0.0000597978,0.00002538701,0.0000199007,0.00001020071,0.0000988786,0.0008089049],"study_design_scores_gemma":[7.700871e-7,0.0000160349,0.999757,0.000001863488,0.0000029188,0.00000869083,0.00007512129,0.00005993512,0.00001811038,0.000003260439,0.00005479595,0.00000149865],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9987667,0.00008667798,0.00002601421,0.0001137689,0.000005165021,0.000006384133,0.0003559628,0.000006289138,0.0006331441],"genre_scores_gemma":[0.9990946,0.00004494433,0.00004130842,0.00001500152,0.000002683747,0.000004095154,0.0004387061,0.000002056554,0.0003565528],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5037451,"threshold_uncertainty_score":0.9867328,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06411790585150015,"score_gpt":0.4183081263111712,"score_spread":0.3541902204596711,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}