{"id":"W2979656586","doi":"10.1016/j.jclinepi.2019.09.022","title":"Validation of five search filters for retrieval of clinical practice guidelines produced low precision","year":2019,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Clinical practice guidelines implementation","field":"Medicine","cited_by":27,"is_retracted":false,"has_abstract":false,"ca_institutions":"Cochrane; University of British Columbia","funders":"","keywords":"Information retrieval; MEDLINE; Guideline; Computer science; Sensitivity (control systems); Filter (signal processing); Medicine; Data mining; Medical physics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1521267,0.003045911,0.005530096,0.01983774,0.003030874,0.01488529,0.003975412,0.007329232,0.004635197],"category_scores_gemma":[0.6184291,0.001775963,0.006096322,0.008205416,0.002570588,0.006747798,0.003630187,0.002723427,0.002524668],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00420233,"about_ca_system_score_gemma":0.01621602,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01853804,"about_ca_topic_score_gemma":0.01913762,"domain_scores_codex":[0.8226749,0.07763015,0.04916409,0.01475679,0.03196347,0.003810622],"domain_scores_gemma":[0.2282548,0.7115378,0.01504273,0.01695874,0.02643867,0.001767214],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.01318028,0.00180979,0.2894066,0.03123955,0.02266525,0.001074227,0.005968707,0.012684,0.01505068,0.007023532,0.03378175,0.5661157],"study_design_scores_gemma":[0.009838234,0.004967174,0.4260378,0.02760882,0.05363085,0.006175906,0.004521951,0.2369163,0.07991847,0.03655497,0.1121947,0.001634796],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5099735,0.06204747,0.3295535,0.01012882,0.003501944,0.01668978,0.03138598,0.01375693,0.02296195],"genre_scores_gemma":[0.6636717,0.003493947,0.3052367,0.003966882,0.0004693566,0.003252122,0.01697976,0.0009106467,0.002018821],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8478733,"threshold_uncertainty_score":0.8045325,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6973041611700598,"score_gpt":0.6894916784184253,"score_spread":0.007812482751634486,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}