{"id":"W4386656746","doi":"10.1093/eurpub/ckab164.279","title":"Can AI learn to identify systematic reviews on the effectiveness of public health interventions?","year":2021,"lang":"en","type":"article","venue":"European Journal of Public Health","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Relevance (law); Context (archaeology); Psychological intervention; Public health; Medicine; Systematic review; MEDLINE; Upload; Health records; Computer science; Health care; Nursing; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2129789,0.001574953,0.004470259,0.02806723,0.001411071,0.01119489,0.003945686,0.002769187,0.006671307],"category_scores_gemma":[0.7435809,0.001666331,0.00629976,0.01568982,0.001538832,0.0110181,0.004340752,0.00394253,0.002544806],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004508452,"about_ca_system_score_gemma":0.01424667,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007483807,"about_ca_topic_score_gemma":0.01922096,"domain_scores_codex":[0.8051695,0.1176009,0.04165139,0.0109981,0.02328712,0.001293158],"domain_scores_gemma":[0.1797365,0.678149,0.05016275,0.03555926,0.05441694,0.001975634],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001316099,0.000290445,0.04749637,0.05565758,0.008574704,0.0003012472,0.002875922,0.008907188,0.001984344,0.006728469,0.07783237,0.7880352],"study_design_scores_gemma":[0.004689693,0.002889123,0.1294485,0.07644323,0.02397675,0.001451226,0.003734159,0.2862166,0.01303308,0.137372,0.3194475,0.001298117],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1509843,0.1124519,0.3793502,0.2120659,0.01082222,0.02032774,0.04265645,0.03162789,0.03971335],"genre_scores_gemma":[0.3749107,0.01563244,0.5735005,0.01097011,0.002611238,0.006486735,0.01260309,0.001217872,0.002067271],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7870212,"threshold_uncertainty_score":0.9705372,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.8457005850452068,"score_gpt":0.5846972270907277,"score_spread":0.2610033579544792,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}