{"id":"W2942674960","doi":"10.1097/acm.0000000000002769","title":"Addressing the Diversity–Validity Dilemma Using Situational Judgment Tests","year":2019,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Medical Education and Admissions","field":"Medicine","cited_by":56,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Ethnic group; Psychology; Diversity (politics); Medicine; Clinical psychology; Demography; Gerontology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3027098,0.001175352,0.001512323,0.005254558,0.003920678,0.005450745,0.003028982,0.001941445,0.001626475],"category_scores_gemma":[0.6290548,0.0008737959,0.00222308,0.00378464,0.0117246,0.009122856,0.009747447,0.00320486,0.0003139422],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002238707,"about_ca_system_score_gemma":0.005142198,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004192601,"about_ca_topic_score_gemma":0.006989629,"domain_scores_codex":[0.6123461,0.2969087,0.01947779,0.02085006,0.04779249,0.002624833],"domain_scores_gemma":[0.2906241,0.5844447,0.0491068,0.0390714,0.0332685,0.003484436],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001494263,0.00052642,0.7956621,0.001002988,0.003111826,0.0005230941,0.02362286,0.004493986,0.00161164,0.03034122,0.004260094,0.1333496],"study_design_scores_gemma":[0.0007398243,0.004294736,0.6426563,0.002746944,0.001220011,0.002330153,0.02899063,0.06102509,0.01086208,0.2193047,0.02517359,0.0006559583],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8068761,0.001755176,0.1533544,0.00899435,0.00125507,0.001575335,0.0003818481,0.0001723969,0.02563524],"genre_scores_gemma":[0.9808547,0.0001129003,0.01665139,0.001014739,0.0002629237,0.000721281,0.00009035641,0.00003101322,0.0002606481],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3027098,"threshold_uncertainty_score":0.859883,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4712908035099329,"score_gpt":0.4599920520531302,"score_spread":0.01129875145680265,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}