{"id":"W2018155718","doi":"10.1097/acm.0000000000000650","title":"Are Examiners’ Judgments in OSCE-Style Assessments Influenced by Contrast Effects?","year":2015,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":55,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Contrast (vision); Psychology; Formality; Variance (accounting); Clinical psychology; Social psychology; Statistics; Mathematics; Computer science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03083135,0.0004084278,0.000523255,0.0009063696,0.0003960812,0.001494246,0.0006597005,0.0008902678,0.001872809],"category_scores_gemma":[0.2549676,0.0004077002,0.0006996109,0.0006107955,0.001423982,0.001245574,0.001072773,0.0009987925,0.0004595616],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005832118,"about_ca_system_score_gemma":0.0005471624,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001618472,"about_ca_topic_score_gemma":0.002590128,"domain_scores_codex":[0.96918,0.01701556,0.002455851,0.003538463,0.007239244,0.0005709508],"domain_scores_gemma":[0.5522307,0.3442826,0.06802696,0.02167758,0.01162048,0.002161731],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00211051,0.0002380514,0.9585686,0.0002660867,0.0005663604,0.0001374374,0.001854246,0.000268244,0.006530616,0.000236692,0.0004896783,0.02873357],"study_design_scores_gemma":[0.0000250417,0.0004939687,0.9952732,0.00004426777,0.0001060647,0.0001394801,0.0002000464,0.0003684878,0.002749664,0.0001902466,0.0003886182,0.00002112956],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9876553,0.001881853,0.004910388,0.0003900646,0.0001234361,0.00009116198,0.0001507464,0.00006848585,0.004728573],"genre_scores_gemma":[0.997736,0.0001098601,0.00152188,0.0002125807,0.00005288726,0.00003003344,0.0000772374,0.00002968521,0.0002297441],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9691687,"threshold_uncertainty_score":0.1630538,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5175988496754704,"score_gpt":0.5339994156305645,"score_spread":0.01640056595509409,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}