{"id":"W4413854149","doi":"10.1016/j.jclinepi.2025.111962","title":"Trustworthiness of treatment clinical practice guidelines has modestly improved since the introduction of Institute of Medicine standards: a systematic survey","year":2025,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Clinical practice guidelines implementation","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":false,"ca_institutions":"Impact; University of Ottawa; McMaster University","funders":"Einstein Stiftung Berlin","keywords":"Trustworthiness; Medicine; Alternative medicine; Systematic review; Clinical Practice; Family medicine; MEDLINE; Evidence-based medicine; Psychology; Political science; Pathology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2691764,0.0002861824,0.001800099,0.005071441,0.001131082,0.004189129,0.003112844,0.003212982,0.001651529],"category_scores_gemma":[0.7623552,0.00164712,0.002856936,0.008139933,0.003527811,0.005837002,0.003399443,0.005791429,0.000216516],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007829005,"about_ca_system_score_gemma":0.02296813,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03790879,"about_ca_topic_score_gemma":0.0531714,"domain_scores_codex":[0.6637932,0.1734936,0.08615761,0.01468955,0.05891093,0.002955173],"domain_scores_gemma":[0.09210057,0.6056252,0.1897293,0.03368159,0.07463792,0.004225492],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008017897,0.0002478734,0.8671123,0.01217744,0.005823849,0.0001081997,0.01157326,0.0005385745,0.0001231253,0.00278757,0.00879613,0.08990981],"study_design_scores_gemma":[0.0004456706,0.0005165493,0.9479713,0.02327642,0.00319209,0.0002006909,0.003846553,0.001461855,0.0003511972,0.002108227,0.01645256,0.0001768899],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7365167,0.1250429,0.01174109,0.09998164,0.002773219,0.001218251,0.008557878,0.0001615474,0.01400669],"genre_scores_gemma":[0.9807628,0.009225027,0.003425044,0.004521173,0.0004403592,0.0002284499,0.001098921,0.00004541425,0.0002529043],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7308236,"threshold_uncertainty_score":0.9012356,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.658780580790509,"score_gpt":0.659997611965975,"score_spread":0.001217031175465899,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}