{"id":"W2588982045","doi":"10.1097/acm.0000000000001559","title":"Transforming Medical Assessment: Integrating Uncertainty Into the Evaluation of Clinical Reasoning in Medical Education","year":2017,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":77,"is_retracted":false,"has_abstract":true,"ca_institutions":"Royal College of Physicians and Surgeons of Canada; University of Calgary","funders":"","keywords":"Context (archaeology); MEDLINE; Engineering ethics; Management science; Field (mathematics); Psychology; Medical education; Medicine; Knowledge management; Computer science; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","research_integrity","insufficient_payload"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.04051473,0.0002198605,0.0009591025,0.0001391728,0.0002369601,0.00001038443,0.0007667702,0.0008240353,0.001296694],"category_scores_gemma":[0.6309383,0.0001269184,0.0001449374,0.0002196338,0.001264998,0.0001335248,0.0001181972,0.003040216,0.00000711081],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001632347,"about_ca_system_score_gemma":0.006682941,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003249082,"about_ca_topic_score_gemma":0.0005374723,"domain_scores_codex":[0.9921196,0.0007391789,0.002340567,0.0004943315,0.003955648,0.0003506815],"domain_scores_gemma":[0.9819213,0.01488295,0.0009577518,0.0009070621,0.0005977962,0.0007330999],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00009775315,0.000109516,0.2851675,0.00004268121,0.00004730063,0.00001542656,0.002582079,0.000004323329,0.00002534974,0.005576072,0.001563549,0.7047684],"study_design_scores_gemma":[0.01859736,0.0009181193,0.7273055,0.0695576,0.001194599,0.0002547971,0.01048385,0.1554947,0.00008281093,0.01199277,0.003741604,0.0003762386],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9038992,0.001632798,0.0005961235,0.07409291,0.001384712,0.0007264638,6.346311e-7,0.00002810725,0.01763904],"genre_scores_gemma":[0.9911907,0.002621648,0.000290499,0.003705997,0.001899209,0.00009110673,0.00004900383,0.00002099022,0.0001308873],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7043922,"threshold_uncertainty_score":0.9996163,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1109682342709774,"score_gpt":0.5498533590944679,"score_spread":0.4388851248234905,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}