{"id":"W2275436624","doi":"10.1080/10401334.2015.1107489","title":"Selecting and Simplifying: Rater Performance and Behavior When Considering Multiple Competencies","year":2016,"lang":"en","type":"article","venue":"Teaching and Learning in Medicine","topic":"Innovations in Medical Education","field":"Medicine","cited_by":66,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; McMaster University; Centennial College","funders":"","keywords":"Inter-rater reliability; Generalizability theory; Psychology; Competence (human resources); Cognition; Task (project management); Applied psychology; Reliability (semiconductor); Quality (philosophy); Clinical psychology; Social psychology; Cognitive psychology; Rating scale; Developmental psychology; Psychiatry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1474197,0.001040977,0.000845388,0.002119283,0.001144118,0.002172163,0.001229393,0.0009548854,0.001061644],"category_scores_gemma":[0.4337237,0.000642286,0.001098829,0.001185209,0.002115616,0.001509393,0.002550358,0.00115167,0.000935159],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009968114,"about_ca_system_score_gemma":0.0008844184,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001318377,"about_ca_topic_score_gemma":0.002300527,"domain_scores_codex":[0.77788,0.1681725,0.01980811,0.009296886,0.02311231,0.001730253],"domain_scores_gemma":[0.5335143,0.3548698,0.04036187,0.03639039,0.0330322,0.001831394],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00454482,0.0008878051,0.4207349,0.002163373,0.001364981,0.0007407108,0.1097586,0.004662553,0.1279088,0.003076454,0.004117362,0.3200396],"study_design_scores_gemma":[0.0005380281,0.007150395,0.7474381,0.001299218,0.0009072196,0.003535968,0.02960809,0.06839793,0.1025593,0.008419574,0.02937715,0.0007690685],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8625078,0.0008631689,0.1241841,0.0006362763,0.0003087056,0.002490561,0.0001994125,0.0005138467,0.008296044],"genre_scores_gemma":[0.8896741,0.0004403752,0.103664,0.0005373646,0.0001719014,0.003067581,0.0002399329,0.0002712733,0.001933466],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1474197,"threshold_uncertainty_score":0.7796392,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03020542520087968,"score_gpt":0.3127546186862993,"score_spread":0.2825491934854197,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}