{"id":"W2003211637","doi":"10.1097/acm.0b013e3181e1b229","title":"To Think Is Good: Querying an Initial Hypothesis Reduces Diagnostic Error in Medical Students","year":2010,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":50,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary; Health Sciences Centre","funders":"","keywords":"Medical diagnosis; Medicine; Diagnostic accuracy; Concordance; Pediatrics; Radiology; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03031618,0.0005627745,0.0006281171,0.001275502,0.001012076,0.002593633,0.001422404,0.002380518,0.002955878],"category_scores_gemma":[0.3038489,0.0004540222,0.0007521664,0.0006131551,0.002742926,0.002384717,0.002727049,0.001705766,0.0006230046],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001215126,"about_ca_system_score_gemma":0.002465988,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001393139,"about_ca_topic_score_gemma":0.001068042,"domain_scores_codex":[0.9758849,0.01499971,0.0016855,0.001713111,0.004925464,0.0007913669],"domain_scores_gemma":[0.7134439,0.2312411,0.03188746,0.008360595,0.009022422,0.006044465],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.008097543,0.004569616,0.6780437,0.0007993475,0.0002425057,0.0005316595,0.01148962,0.001664386,0.003629816,0.0007130773,0.00551188,0.2847068],"study_design_scores_gemma":[0.00221337,0.02602116,0.8902153,0.001478057,0.0008514903,0.002929852,0.01441333,0.01853695,0.02158456,0.01175012,0.009653615,0.0003521224],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9916521,0.0005136947,0.002254901,0.003142224,0.00009319119,0.0001865475,0.00004584483,0.0001260861,0.001985424],"genre_scores_gemma":[0.9928007,0.0001687674,0.005860996,0.0007885704,0.00004737482,0.00006613149,0.0000619147,0.0000111005,0.0001944028],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03031618,"threshold_uncertainty_score":0.1603292,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06561682143505307,"score_gpt":0.446273172229573,"score_spread":0.38065635079452,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}