{"id":"W4391036726","doi":"10.4236/ojepi.2024.141005","title":"Cautionary Remarks When Testing Agreement between Two Raters for Continuous Scale Measurements: A Tutorial in Clinical Epidemiology with Implementation Using R","year":2024,"lang":"en","type":"article","venue":"Open Journal of Epidemiology","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Western University","funders":"","keywords":"Statistic; Scale (ratio); Sample size determination; Statistics; Sample (material); Linear regression; Degrees of freedom (physics and chemistry); Data mining; Computer science; Medicine; Econometrics; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2296385,0.0003135127,0.00232247,0.0004474595,0.0002161511,0.0001494124,0.001439405,0.0002078938,0.0002983991],"category_scores_gemma":[0.05831591,0.0002013205,0.0003976872,0.0005247041,0.0003354592,0.0008341631,0.0003043549,0.0006648405,0.00001653072],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005322691,"about_ca_system_score_gemma":0.0008759371,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006490139,"about_ca_topic_score_gemma":0.0004239247,"domain_scores_codex":[0.9750859,0.01305601,0.00888342,0.001091132,0.0009658327,0.0009177031],"domain_scores_gemma":[0.942783,0.05165753,0.003238348,0.0005610741,0.001429319,0.0003307196],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0006535964,0.0001013662,0.9118069,0.00002509051,0.0002403405,0.00002010896,0.0002041923,0.003143142,0.0003197089,0.0004580141,0.01151331,0.0715142],"study_design_scores_gemma":[0.01415962,0.008068411,0.4736662,0.00198333,0.0008067163,0.0003351009,0.003034183,0.01338615,0.0001845435,0.4174974,0.06587006,0.001008305],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6810825,0.001492444,0.2918952,0.01645016,0.005616895,0.002709637,0.0000617667,0.00001638535,0.0006750639],"genre_scores_gemma":[0.6420902,0.00004882196,0.3530087,0.001885978,0.0027119,0.00007555196,0.000029976,0.00003327496,0.0001155961],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4381407,"threshold_uncertainty_score":0.9496163,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7023443814366066,"score_gpt":0.5922363059400028,"score_spread":0.1101080754966038,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}