{"id":"W2772612024","doi":"10.4300/jgme-d-17-00644.1","title":"On Rating Angels: The Halo Effect and Straight Line Scoring","year":2017,"lang":"en","type":"article","venue":"Journal of Graduate Medical Education","topic":"Innovations in Medical Education","field":"Medicine","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Phenomenon; Suspect; Psychology; Consistency (knowledge bases); Nothing; Rating scale; Halo; Recall; Promotion (chess); Social psychology; Townsend; Cognitive psychology; Epistemology; Computer science; Developmental psychology; Law; Philosophy; Artificial intelligence; Political science; Physics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06477742,0.0009243921,0.00100019,0.005119317,0.002136393,0.003542435,0.001866793,0.00213171,0.01201309],"category_scores_gemma":[0.3026669,0.0007172815,0.0008867165,0.004429358,0.00824328,0.006885932,0.005667991,0.003230323,0.001918357],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003144565,"about_ca_system_score_gemma":0.001420114,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005234363,"about_ca_topic_score_gemma":0.008555661,"domain_scores_codex":[0.9148102,0.04617739,0.004732434,0.004673475,0.02863821,0.000968391],"domain_scores_gemma":[0.6574059,0.236108,0.04460779,0.02812055,0.02948512,0.004272688],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.001903732,0.0004898374,0.3703532,0.001111593,0.00085002,0.001016644,0.03856769,0.001576043,0.001889382,0.08258343,0.09831779,0.4013406],"study_design_scores_gemma":[0.0006187059,0.001464755,0.6684377,0.003874675,0.0004558837,0.004709096,0.02710776,0.01186861,0.003187274,0.1684667,0.1089414,0.0008674074],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5827515,0.01925804,0.09583837,0.02811135,0.006268387,0.00259483,0.001813711,0.001546131,0.2618177],"genre_scores_gemma":[0.9558128,0.003642962,0.01741019,0.009942079,0.001369806,0.001094543,0.0006040092,0.0005879677,0.00953572],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9352226,"threshold_uncertainty_score":0.3425798,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03896792197588554,"score_gpt":0.3992918764495688,"score_spread":0.3603239544736832,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}