{"id":"W2974998223","doi":"10.1080/00273171.2019.1660605","title":"New Recommendations on the Use of R-Squared Differences in Multilevel Model Comparisons","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":96,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Set (abstract data type); Mean squared error; Measure (data warehouse); Multilevel model; Computer science; Class (philosophy); Confusion; Data mining; Statistics; Mathematics; Artificial intelligence; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2495289,0.00417125,0.004346988,0.01207864,0.002701098,0.008575032,0.01306575,0.0120227,0.04469369],"category_scores_gemma":[0.7133957,0.005385472,0.009831156,0.01675979,0.008873775,0.02023868,0.007440882,0.02829335,0.02634861],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005653981,"about_ca_system_score_gemma":0.01475258,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01782506,"about_ca_topic_score_gemma":0.0240068,"domain_scores_codex":[0.7019737,0.2243362,0.03252136,0.00995785,0.02926531,0.001945707],"domain_scores_gemma":[0.216244,0.5890774,0.02246897,0.04971926,0.1177742,0.00471606],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003580295,0.0003209097,0.002348467,0.006004928,0.000436534,0.0002029672,0.001696559,0.002525305,0.000525263,0.05336828,0.7031774,0.2290355],"study_design_scores_gemma":[0.0008929859,0.000429068,0.005978473,0.03459388,0.0006505762,0.0006256709,0.001664713,0.01042589,0.002320684,0.1645161,0.7770197,0.0008821504],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001801623,0.03534436,0.6432895,0.2318324,0.03930673,0.002889771,0.01009374,0.008009012,0.02743284],"genre_scores_gemma":[0.008438258,0.01225097,0.9158364,0.03771412,0.005321877,0.005940678,0.002702932,0.004306785,0.007487909],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7504711,"threshold_uncertainty_score":0.9254644,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8895675119762272,"score_gpt":0.598556855129321,"score_spread":0.2910106568469062,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}