{"id":"W2023466828","doi":"10.1111/j.0965-075x.2005.00307.x","title":"Who Will Evaluate Me? Rater Selection in Multi‐Source Assessment Contexts","year":2005,"lang":"en","type":"article","venue":"International Journal of Selection and Assessment","topic":"Student Assessment and Feedback","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Montreal Clinical Research Institute; Concordia University","funders":"","keywords":"Psychology; Preference; Affect (linguistics); Selection (genetic algorithm); Inter-rater reliability; Social psychology; Performance appraisal; Applied psychology; Developmental psychology; Rating scale; Statistics; Computer science; Communication","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001772128,0.0001479025,0.0002416422,0.0004127467,0.0002175473,0.000311602,0.0002519287,0.00009108653,0.0006079566],"category_scores_gemma":[0.00004970931,0.0001406286,0.00009696204,0.000256012,0.00006491081,0.001040261,0.00004370082,0.0004274822,0.000006140276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001084272,"about_ca_system_score_gemma":0.0004463065,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002643235,"about_ca_topic_score_gemma":0.001947342,"domain_scores_codex":[0.9974731,0.000328657,0.0005939282,0.0002012913,0.001150665,0.0002523153],"domain_scores_gemma":[0.9985307,0.0001019476,0.0004362368,0.00003471163,0.0007707824,0.0001256013],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002167939,0.001241607,0.8069745,0.000008863414,0.0005266881,0.00001658393,0.006141413,0.002660328,0.01202751,0.008073498,0.002339523,0.1597727],"study_design_scores_gemma":[0.005345988,0.0003582691,0.7911665,0.0002008732,0.00007186007,0.00006479411,0.003976132,0.02852436,0.000480309,0.0003732698,0.1690639,0.0003736577],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9561118,0.0001878241,0.02314755,0.01162843,0.001274434,0.0003409008,0.000002103945,0.00003845443,0.007268462],"genre_scores_gemma":[0.9883273,0.0008568348,0.006715229,0.0003882289,0.0008362373,0.00001079074,0.000002398683,0.0000126542,0.002850329],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1667244,"threshold_uncertainty_score":0.6656698,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03028675750328179,"score_gpt":0.4241642399649722,"score_spread":0.3938774824616904,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}