{"id":"W3005727251","doi":"10.1016/j.jclinepi.2019.12.020","title":"GRADE guidelines: 21 part 1. Study design, risk of bias, and indirectness in rating the certainty across a body of evidence for test accuracy","year":2020,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":383,"is_retracted":false,"has_abstract":false,"ca_institutions":"Ottawa Public Health; McGill University; Impact; McMaster University","funders":"European Commission","keywords":"Certainty; Test (biology); Guideline; Quality of evidence; Research design; Evidence-based medicine; Systematic review; Psychology; Evidence-based practice; Quality (philosophy); MEDLINE; Medicine; Medical physics; Applied psychology; Meta-analysis; Medical education; Alternative medicine; Statistics; Pathology; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7362735,0.0002398011,0.01158,0.0001148053,0.00009165451,0.00005534205,0.001897147,0.0001791047,0.0001088821],"category_scores_gemma":[0.9896314,0.00008362583,0.0025096,0.000877495,0.0003287104,0.0002174082,0.0002289746,0.0006816619,0.000007750053],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000009469281,"about_ca_system_score_gemma":0.0002458277,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0000486235,"about_ca_topic_score_gemma":0.00006281952,"domain_scores_codex":[0.6172314,0.2479116,0.1289127,0.001564599,0.003651121,0.0007285062],"domain_scores_gemma":[0.03444554,0.8958907,0.06472286,0.001337663,0.003324913,0.0002783007],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001983269,0.0001825177,0.961413,0.00005787609,0.0002802715,0.000004112567,0.0007497483,0.001967464,0.00002401126,0.00002520143,0.01112674,0.02397078],"study_design_scores_gemma":[0.001975013,0.003162413,0.8951593,0.0005203756,0.0008358271,0.0000242883,0.006345631,0.07502864,0.00003210253,0.01008932,0.006650904,0.0001761516],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.893595,0.003202287,0.08389865,0.01777195,0.0003106578,0.001199219,0.00001624128,0.000001138889,0.000004807873],"genre_scores_gemma":[0.9765685,0.001261981,0.02028363,0.001448605,0.0003835425,0.00001921049,2.285882e-7,0.000007569197,0.00002677145],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6479791,"threshold_uncertainty_score":0.7915854,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9877785009089068,"score_gpt":0.7526033643857505,"score_spread":0.2351751365231564,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}