{"id":"W2980714529","doi":"10.30476/jamp.2019.83101.1083","title":"Combination of different clinical reasoning tests in a national exam.","year":2019,"lang":"en","type":"article","venue":"PubMed","topic":"Clinical Reasoning and Diagnostic Skills","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Olympiad; Cronbach's alpha; Test (biology); Shahid; Reliability (semiconductor); Concordance; Medical education; Descriptive statistics; Medicine; Psychology; Mathematics education; Statistics; Mathematics; Internal medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003268462,0.0006318845,0.0006032622,0.001914902,0.0003660381,0.000756235,0.0007302574,0.0004294391,0.003488751],"category_scores_gemma":[0.01023817,0.0002168581,0.0007733937,0.001337048,0.0002839231,0.0007870803,0.0009893493,0.0006779885,0.0007823059],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004546209,"about_ca_system_score_gemma":0.001145416,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001495555,"about_ca_topic_score_gemma":0.003250966,"domain_scores_codex":[0.9980538,0.0003716115,0.000466848,0.0002837291,0.0006767969,0.0001473256],"domain_scores_gemma":[0.9936958,0.001357557,0.002510147,0.0002735987,0.001462778,0.0007001476],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002824204,0.0008888,0.9314483,0.0002016206,0.0001577631,0.0001758038,0.0003338666,0.0006065735,0.001232352,0.0001138109,0.002027528,0.06253105],"study_design_scores_gemma":[0.00004640756,0.001068369,0.9929565,0.00008080634,0.00008294427,0.0007470675,0.000352311,0.001611671,0.001256725,0.0001888313,0.001586463,0.00002182809],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9892305,0.0005002475,0.001848446,0.00028042,0.00007873064,0.0004863224,0.001137873,0.0001216644,0.006315753],"genre_scores_gemma":[0.9865739,0.0003510838,0.009712344,0.00009650293,0.00003203079,0.0003049513,0.001476302,0.000009986844,0.001442943],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003488751,"threshold_uncertainty_score":0.01728553,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05152377725123081,"score_gpt":0.3506013692919797,"score_spread":0.2990775920407489,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}