{"id":"W2054627871","doi":"10.1016/j.amjsurg.2011.11.006","title":"The script concordance test as a measure of clinical reasoning: a national validation study","year":2012,"lang":"en","type":"article","venue":"The American Journal of Surgery","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":71,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of British Columbia; University of Ottawa; Western University; Queen's University; McMaster University; University of Alberta; Université de Montréal; Memorial University of Newfoundland; University of Calgary; McGill University","funders":"","keywords":"Concordance; Cronbach's alpha; Test (biology); Reliability (semiconductor); Measure (data warehouse); Medicine; Medical physics; Psychology; Clinical psychology; Psychometrics; Data mining; Internal medicine; Computer science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0141682,0.0001104316,0.0007486513,0.00006657952,0.0001109947,0.00001848241,0.0001725382,0.00002759738,0.00002290538],"category_scores_gemma":[0.2595423,0.00005511891,0.0003840884,0.0003614046,0.0006125569,0.00008652189,0.00003210774,0.0004541797,0.00001634689],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004065591,"about_ca_system_score_gemma":0.0007698743,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00005906995,"about_ca_topic_score_gemma":8.484607e-7,"domain_scores_codex":[0.9966962,0.0006128681,0.001325038,0.00009703398,0.001037133,0.0002316855],"domain_scores_gemma":[0.8689824,0.1258178,0.003082316,0.0003909024,0.001352826,0.0003737496],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008713523,0.001052904,0.9523399,0.000002052775,0.0002038089,0.00001357366,0.000237582,0.000003276466,0.00004186603,0.00006514324,0.005102615,0.04006594],"study_design_scores_gemma":[0.000677503,0.0009288355,0.9938265,0.0005931979,0.0002354267,0.0003737408,0.00195381,0.0000135082,0.00009539622,0.0001149373,0.001120737,0.00006640537],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9947141,0.0007067644,0.0000419678,0.002999598,0.0007272745,0.0001301214,0.000002744941,0.000007889534,0.0006695787],"genre_scores_gemma":[0.9975774,0.0003109306,0.0001485042,0.0007279091,0.001101562,0.000004444644,0.000001116582,0.00001418943,0.000113976],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2453742,"threshold_uncertainty_score":0.7466949,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1085774429683783,"score_gpt":0.4208620363548373,"score_spread":0.312284593386459,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}