{"id":"W3134270660","doi":"10.1515/dx-2020-0127","title":"Real-world virtual patient simulation to improve diagnostic performance through deliberate practice: a prospective quasi-experimental study","year":2021,"lang":"en","type":"article","venue":"Diagnosis","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":20,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ottawa Hospital","funders":"National Institute on Deafness and Other Communication Disorders; Center for Innovative Medicine, Johns Hopkins University","keywords":"Computer science; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0002862225,0.0003351643,0.0005871014,0.00009318723,0.000203738,0.00009705649,0.00009567429,0.0001015286,0.0003662681],"category_scores_gemma":[0.07217759,0.0003080786,0.0001558326,0.0007856433,0.0000559442,0.0003276389,0.0001894847,0.0003444817,0.0002660655],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003935968,"about_ca_system_score_gemma":0.0002575943,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004526644,"about_ca_topic_score_gemma":0.00008422361,"domain_scores_codex":[0.997068,0.0001978775,0.0006915398,0.0008728908,0.0007071779,0.00046253],"domain_scores_gemma":[0.9736257,0.02455406,0.0001971737,0.0006084045,0.000652929,0.0003617805],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00135594,0.05778588,0.8731992,0.00003499917,0.0004930607,0.001219149,0.01640113,0.007355699,0.0001694441,0.0004010323,0.002618448,0.03896598],"study_design_scores_gemma":[0.01456933,0.07366014,0.7747601,0.003715682,0.001808463,0.00006541577,0.02526024,0.007602632,0.08390136,0.00009396924,0.01282627,0.001736407],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9920294,0.000258348,0.00009999731,0.001811448,0.0005971147,0.002189652,0.00003286959,0.0001491961,0.002831985],"genre_scores_gemma":[0.9926001,0.0004233174,0.001359068,0.002966942,0.0003374641,0.001744252,0.00006293446,0.00006191986,0.0004439432],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.09843914,"threshold_uncertainty_score":0.9999371,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02506591494448544,"score_gpt":0.376989907677249,"score_spread":0.3519239927327636,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}