{"id":"W2118786685","doi":"10.1111/j.1365-2929.2006.02541.x","title":"Assessment of clinical reasoning in the context of uncertainty: the effect of variability within the reference panel","year":2006,"lang":"en","type":"article","venue":"Medical Education","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":68,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Concordance; Context (archaeology); Cronbach's alpha; Test (biology); Statistics; Psychology; Medicine; Clinical psychology; Mathematics; Psychometrics; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03918651,0.0007560678,0.001086387,0.001449356,0.0004092597,0.001304038,0.0007261391,0.0008971303,0.001159644],"category_scores_gemma":[0.2042656,0.0004390728,0.001181991,0.0008900117,0.001420815,0.001497253,0.002039859,0.001537979,0.0001788319],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005321618,"about_ca_system_score_gemma":0.0005343247,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006534785,"about_ca_topic_score_gemma":0.0009957597,"domain_scores_codex":[0.9299793,0.04659228,0.003686959,0.004077894,0.01506964,0.0005940323],"domain_scores_gemma":[0.4676584,0.4900527,0.02132155,0.01133726,0.007154455,0.002475547],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.02161624,0.002218129,0.7623786,0.000673965,0.00382846,0.0007664579,0.009970518,0.006703283,0.02332055,0.0004710795,0.001081355,0.1669714],"study_design_scores_gemma":[0.0002399569,0.01021534,0.9676278,0.0001847286,0.0005957729,0.001041909,0.001031116,0.009444345,0.007503638,0.00079315,0.001178511,0.0001437173],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9904654,0.0006275731,0.00648349,0.0001291571,0.00005390723,0.000131231,0.00008295543,0.00006473947,0.001961443],"genre_scores_gemma":[0.996052,0.0001349219,0.003261697,0.00005715678,0.00002792288,0.00007467614,0.0001084066,0.00002684644,0.000256331],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03918651,"threshold_uncertainty_score":0.2072406,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03606216007835677,"score_gpt":0.436004507679344,"score_spread":0.3999423476009872,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}