{"id":"W3006084164","doi":"10.1186/s13643-020-01291-z","title":"Inter-rater reliability and validity of risk of bias instrument for non-randomized studies of exposures: a study protocol","year":2020,"lang":"en","type":"article","venue":"Systematic Reviews","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"Public Health Ontario; Queen's University; George & Fay Yee Centre for Healthcare Innovation; University of Toronto; University of Ottawa; St. Michael's Hospital; University of Manitoba","funders":"","keywords":"Medicine; Protocol (science); Concordance; Reliability (semiconductor); Concurrent validity; Inter-rater reliability; Medical physics; Statistic; Applied psychology; Medical education; Clinical psychology; Psychology; Statistics; Internal consistency; Psychometrics; Rating scale; Alternative medicine; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.09922087,0.0002746112,0.005178917,0.00009072645,0.00005647149,0.00003177128,0.0005945094,0.0000468028,0.00003185657],"category_scores_gemma":[0.1479478,0.0001212533,0.0007214319,0.0003898329,0.0003527789,0.0001300236,0.0002286131,0.00008291111,0.0000071984],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00002902463,"about_ca_system_score_gemma":0.00004634481,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002561436,"about_ca_topic_score_gemma":0.00001676929,"domain_scores_codex":[0.9770829,0.01217262,0.008302964,0.000600927,0.001679555,0.000161005],"domain_scores_gemma":[0.9787067,0.01266611,0.005862067,0.001274431,0.001402784,0.00008797518],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"randomized_trial","study_design_scores_codex":[0.01107021,0.002323215,0.1928081,0.6880448,0.001221845,6.232079e-7,0.09792402,0.00005707189,0.0005663576,0.0001292755,0.002247282,0.003607112],"study_design_scores_gemma":[0.4137082,0.03096201,0.01423851,0.1469221,0.008852904,0.000005421009,0.2671936,0.01144809,0.02134572,0.07272542,0.01000337,0.002594694],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"protocol","genre_gemma":"empirical","genre_scores_codex":[0.4503136,0.0004034464,0.005490968,0.0001655666,0.0001463786,0.5433877,0.00002710185,0.000006581005,0.00005870093],"genre_scores_gemma":[0.8243328,0.0001094965,0.003021729,0.00002254736,0.00002118937,0.1724671,3.441913e-7,0.000006800704,0.00001800928],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.5411228,"threshold_uncertainty_score":0.9275417,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5050424449137488,"score_gpt":0.4703065683931101,"score_spread":0.0347358765206387,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}