{"id":"W2979656586","doi":"10.1016/j.jclinepi.2019.09.022","title":"Validation of five search filters for retrieval of clinical practice guidelines produced low precision","year":2019,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Clinical practice guidelines implementation","field":"Medicine","cited_by":27,"is_retracted":false,"has_abstract":false,"ca_institutions":"Cochrane; University of British Columbia","funders":"","keywords":"Information retrieval; MEDLINE; Guideline; Computer science; Sensitivity (control systems); Filter (signal processing); Medicine; Data mining; Medical physics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1840734,0.0002315749,0.004605005,0.00023422,0.00002916903,0.000005224339,0.000387755,0.0007029718,0.0002127996],"category_scores_gemma":[0.9052808,0.0001692629,0.001777314,0.0003182374,0.0003250824,0.00050253,0.0001445467,0.001511078,0.00002703528],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004953369,"about_ca_system_score_gemma":0.001709346,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004587903,"about_ca_topic_score_gemma":0.00000145011,"domain_scores_codex":[0.9572049,0.008309833,0.03232538,0.0006812692,0.001031877,0.0004467515],"domain_scores_gemma":[0.5259165,0.4230857,0.02920103,0.001196065,0.01997902,0.0006216707],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.1317859,0.004375319,0.5269453,0.001239272,0.002291209,0.00002993641,0.0001885799,0.004540215,0.006591373,0.0006030485,0.1019597,0.2194502],"study_design_scores_gemma":[0.08156463,0.09198836,0.5976723,0.004221324,0.006534703,0.001042242,0.003374666,0.05434645,0.02105832,0.01124246,0.1259285,0.001026036],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.92037,0.0002119166,0.01522795,0.05894767,0.003705805,0.001360362,0.00002969094,0.000009494317,0.0001370885],"genre_scores_gemma":[0.6402626,0.002049625,0.3434927,0.009543549,0.004131574,0.000004447196,0.00007499752,0.00004933272,0.0003911346],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7212074,"threshold_uncertainty_score":0.8401681,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6973041611700598,"score_gpt":0.6894916784184253,"score_spread":0.007812482751634486,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}