{"id":"W4318142103","doi":"10.1371/journal.pone.0280493","title":"Validity of constructed-response situational judgment tests in training programs for the health professions: A systematic review and meta-analysis protocol","year":2023,"lang":"en","type":"review","venue":"PLoS ONE","topic":"Medical Education and Admissions","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"University of Guelph","keywords":"Situational ethics; Data extraction; Applied psychology; Meta-analysis; Protocol (science); Test (biology); Psychology; Interpersonal communication; MEDLINE; Quality (philosophy); Medical education; Computer science; Social psychology; Medicine; Alternative medicine","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.005762898,0.0002738369,0.006738525,0.0003050501,0.0001005837,0.00001269156,0.0001527859,0.0001217817,0.0004984629],"category_scores_gemma":[0.02394207,0.0001306606,0.0009169662,0.001344345,0.00009874794,0.00001976404,0.0000462538,0.0003706484,0.000005257678],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001014033,"about_ca_system_score_gemma":0.004409595,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000006093175,"about_ca_topic_score_gemma":0.000009302458,"domain_scores_codex":[0.9952148,0.001538108,0.001953505,0.0003443582,0.0007191792,0.0002300583],"domain_scores_gemma":[0.9931058,0.004399462,0.001293467,0.0005145749,0.0002335348,0.0004531881],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"meta_analysis","study_design_scores_codex":[0.00001625033,0.0009701517,0.000002031608,0.9591312,0.03715255,8.857074e-7,0.0002683489,1.27891e-8,1.44191e-7,0.00003120687,0.0001954304,0.002231813],"study_design_scores_gemma":[0.0003050884,0.0001880746,0.000006722221,0.4075885,0.5878847,0.00000699856,0.0002807088,0.00002868649,1.624232e-7,0.00002329915,0.003577998,0.0001089957],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[7.300235e-7,0.7129448,0.00002334687,0.008754933,0.000007446259,0.2781504,0.00008829567,0.00002707854,0.000002990576],"genre_scores_gemma":[0.000002682996,0.5074236,0.001615179,0.0007906744,0.00001743389,0.4891397,0.0001522021,0.00002280586,0.0008357597],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.5515426,"threshold_uncertainty_score":0.9842797,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6866098787776079,"score_gpt":0.5254294774272179,"score_spread":0.16118040135039,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}