{"id":"W2012944180","doi":"10.1016/j.jclinepi.2009.04.007","title":"Systematic review data extraction: cross-sectional study showed that experience did not increase accuracy","year":2009,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":80,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Alberta; Capital District Health Authority","funders":"Agency for Healthcare Research and Quality","keywords":"Data extraction; Meta-analysis; Systematic review; Extraction (chemistry); Statistics; Medicine; MEDLINE; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3289186,0.002398762,0.00622991,0.01030866,0.001955847,0.004113753,0.003083849,0.00299995,0.009945801],"category_scores_gemma":[0.7675805,0.00308064,0.01316509,0.01273437,0.002703266,0.006687489,0.003393426,0.00226429,0.002236846],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003142406,"about_ca_system_score_gemma":0.008876015,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002738387,"about_ca_topic_score_gemma":0.006634111,"domain_scores_codex":[0.4263595,0.2058892,0.3133812,0.01832187,0.03369331,0.002354873],"domain_scores_gemma":[0.1142864,0.7305027,0.06637653,0.05001363,0.03790462,0.0009162371],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.008080382,0.0005402917,0.5195618,0.2115038,0.08750117,0.001800257,0.01131462,0.001411893,0.00237258,0.003939098,0.01833181,0.1336423],"study_design_scores_gemma":[0.009018688,0.005410359,0.5740659,0.1056017,0.200072,0.004270921,0.004264212,0.007988713,0.0128079,0.01664429,0.05885224,0.00100311],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.367496,0.1746534,0.2520436,0.01408862,0.005310149,0.07708529,0.08195099,0.001647706,0.02572427],"genre_scores_gemma":[0.8575186,0.014222,0.06549942,0.007165682,0.000881423,0.04020956,0.01043994,0.0007947937,0.003268634],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6710814,"threshold_uncertainty_score":0.8275628,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9550334104217747,"score_gpt":0.7403269771706922,"score_spread":0.2147064332510825,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}