{"id":"W2167816954","doi":"10.2466/pr0.101.3.1001-1010","title":"Four Multi-Item Interrater Agreement Options: Comparisons and Outcomes","year":2007,"lang":"en","type":"article","venue":"Psychological Reports","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Inter-rater reliability; Intraclass correlation; Psychology; Agreement; Statistics; Psychometrics; Clinical psychology; Rating scale; Developmental psychology; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2294976,0.001435554,0.001493476,0.006479306,0.001863754,0.003164653,0.002232235,0.001608718,0.002717945],"category_scores_gemma":[0.4032728,0.000804113,0.002495352,0.006227625,0.003758689,0.006113807,0.006056293,0.002146758,0.001145436],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001346363,"about_ca_system_score_gemma":0.001828645,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005681187,"about_ca_topic_score_gemma":0.001464123,"domain_scores_codex":[0.6979256,0.2213454,0.03682291,0.007940652,0.03393222,0.002033189],"domain_scores_gemma":[0.4028477,0.4815357,0.04316638,0.02160425,0.04850914,0.002336876],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01497909,0.001306588,0.4669267,0.005174898,0.004972776,0.0003808017,0.03202938,0.008859375,0.00496674,0.01656474,0.003544218,0.4402948],"study_design_scores_gemma":[0.002331391,0.02267925,0.683593,0.004461283,0.005203458,0.003524936,0.05855392,0.0798591,0.04687744,0.06901369,0.02214947,0.001752985],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8104301,0.002734973,0.1569432,0.0005633305,0.0004808638,0.004825365,0.001500821,0.0005998544,0.02192143],"genre_scores_gemma":[0.9424715,0.0003568677,0.05179159,0.00006083926,0.00008690794,0.003765137,0.0004871885,0.0001438971,0.0008360594],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7705024,"threshold_uncertainty_score":0.9501667,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4302605755541647,"score_gpt":0.4916184474274782,"score_spread":0.06135787187331354,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}