{"id":"W2134799834","doi":"10.1093/ije/29.6.1070","title":"The effect of collapsing multinomial data when assessing agreement","year":2000,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"","keywords":"Multinomial distribution; Agreement; Medicine; Statistics; Econometrics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.5136499,0.00173823,0.003020697,0.004276391,0.003269766,0.005560142,0.003842777,0.004474631,0.002813509],"category_scores_gemma":[0.8400962,0.00181583,0.004973845,0.00559269,0.01374672,0.01116826,0.009659805,0.006381457,0.0005042285],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002496805,"about_ca_system_score_gemma":0.003004663,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001807472,"about_ca_topic_score_gemma":0.001590525,"domain_scores_codex":[0.2763081,0.6520633,0.0293916,0.01713647,0.02325503,0.001845348],"domain_scores_gemma":[0.02616883,0.9217335,0.01643393,0.03033406,0.00480947,0.0005203224],"domain_codex":"methods","domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01065038,0.0006620621,0.3571253,0.004037136,0.008805807,0.001323326,0.02082199,0.06194356,0.006760018,0.07877196,0.00408574,0.4450129],"study_design_scores_gemma":[0.001744628,0.007532507,0.2294428,0.006003053,0.00632786,0.005532724,0.00751099,0.2685197,0.03017124,0.41871,0.01735219,0.001152331],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1504774,0.002469981,0.8375825,0.002743193,0.0003713852,0.001404793,0.000368721,0.000547717,0.004034354],"genre_scores_gemma":[0.6009499,0.0004606489,0.3944065,0.001380988,0.0001725518,0.001769241,0.0002988325,0.0002236141,0.0003377727],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.5136499,"threshold_uncertainty_score":0.5997562,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2977449565525722,"score_gpt":0.4964184161530347,"score_spread":0.1986734596004625,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}