{"id":"W2103281609","doi":"10.1111/medu.12777","title":"Relatively speaking: contrast effects influence assessors’ scores and narrative feedback","year":2015,"lang":"en","type":"article","venue":"Medical Education","topic":"Medical Education and Admissions","field":"Medicine","cited_by":33,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"National Institute for Health and Care Research","keywords":"Contrast (vision); Narrative; Psychology; Audiology; Social psychology; Linguistics; Medicine; Computer science; Artificial intelligence; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03499528,0.0004621018,0.0005464861,0.0007295068,0.0006165099,0.002163955,0.0007398775,0.001344106,0.004516693],"category_scores_gemma":[0.3199966,0.0003832925,0.000720181,0.0004016694,0.002088824,0.001695417,0.001870271,0.0009877124,0.0005760199],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008291933,"about_ca_system_score_gemma":0.0008014869,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008281991,"about_ca_topic_score_gemma":0.0009352998,"domain_scores_codex":[0.9544016,0.02681445,0.002944693,0.005326496,0.009888767,0.0006240613],"domain_scores_gemma":[0.5755737,0.3498349,0.04795201,0.01586594,0.007973296,0.002800107],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0234198,0.0009412974,0.6938029,0.002258067,0.002282004,0.0005003079,0.0160821,0.00171622,0.06730068,0.00295699,0.002209033,0.1865306],"study_design_scores_gemma":[0.0003788829,0.005517163,0.9689682,0.0003644766,0.0004524285,0.0004445591,0.001351986,0.001769175,0.01586343,0.002665964,0.002110848,0.0001129422],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.975652,0.001436577,0.01349286,0.0005915796,0.000236944,0.0002899363,0.0002080535,0.00009179318,0.008000279],"genre_scores_gemma":[0.995165,0.0001174145,0.003818921,0.0002470017,0.0000798895,0.0001112428,0.00007557686,0.00003466264,0.0003503082],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9650047,"threshold_uncertainty_score":0.1850749,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02302402299088791,"score_gpt":0.3671345273383101,"score_spread":0.3441105043474222,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}