{"id":"W2961552777","doi":"10.1016/j.jclinepi.2019.07.005","title":"A randomized trial provided new evidence on the accuracy and efficiency of traditional vs. electronically annotated abstraction approaches in systematic reviews","year":2019,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":55,"is_retracted":false,"has_abstract":true,"ca_institutions":"Cochrane; National Research Council Canada","funders":"Agency for Healthcare Research and Quality; Patient-Centered Outcomes Research Institute","keywords":"Abstraction; Computer science; Confidence interval; Software verification; Randomized controlled trial; Odds ratio; Data mining; Medicine; Programming language; Software; Surgery; Internal medicine; Software system","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3677644,0.002689919,0.01232152,0.004643137,0.002123587,0.009562998,0.002426754,0.009094787,0.01314479],"category_scores_gemma":[0.7226843,0.002738701,0.02228946,0.00684928,0.005552958,0.01692026,0.004413335,0.006445054,0.001833741],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007145285,"about_ca_system_score_gemma":0.01567938,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001975943,"about_ca_topic_score_gemma":0.003228615,"domain_scores_codex":[0.4056659,0.4511664,0.1009801,0.01682003,0.02334061,0.002026987],"domain_scores_gemma":[0.1804171,0.6806593,0.081683,0.03163466,0.02376129,0.001844652],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"systematic_review","study_design_gemma":"randomized_trial","study_design_scores_codex":[0.2521317,0.001359529,0.009187081,0.4198346,0.1328793,0.0002090167,0.002191988,0.002202779,0.001535637,0.006045487,0.008203077,0.1642199],"study_design_scores_gemma":[0.4468675,0.0329495,0.01343692,0.2133843,0.2462076,0.0004728964,0.0008815679,0.004536324,0.003583499,0.01257276,0.02441378,0.0006934369],"study_design_candidate":"randomized_trial","study_design_consensus":null,"genre_codex":"review","genre_gemma":"empirical","genre_scores_codex":[0.1563089,0.5640743,0.1031539,0.02572784,0.03453838,0.0941525,0.005384411,0.002110008,0.01454982],"genre_scores_gemma":[0.6952925,0.0628759,0.1448684,0.01070731,0.004989832,0.07743734,0.001457229,0.0004780605,0.001893433],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.6322356,"threshold_uncertainty_score":0.779659,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9429509968337885,"score_gpt":0.632094509033019,"score_spread":0.3108564878007695,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}