{"id":"W4281291249","doi":"10.1111/jep.13699","title":"The quality of four psychology practice guidelines using the Appraisal of Guidelines for Research and Evaluation (AGREE) II","year":2022,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Clinical practice guidelines implementation","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; Centres Intégré Universitaires de Santé et de Services Sociaux; Université du Québec; McGill University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Psychology; Quality (philosophy); Applied psychology; Medical education; Management science; Engineering ethics; Medicine; Epistemology; Philosophy; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"evaluation","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"evaluation","study_design":"observational","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.437579,0.002153106,0.006791139,0.02717985,0.005012529,0.01090623,0.00686538,0.0055469,0.001980326],"category_scores_gemma":[0.6389493,0.002372353,0.01029326,0.0197645,0.004721052,0.004135484,0.009569921,0.007335899,0.0006589442],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01976581,"about_ca_system_score_gemma":0.1136016,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01542092,"about_ca_topic_score_gemma":0.03791615,"domain_scores_codex":[0.3739635,0.3416765,0.1868052,0.01020104,0.08312609,0.004227691],"domain_scores_gemma":[0.2801228,0.3172579,0.1237464,0.02513549,0.2429579,0.01077961],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.00217346,0.001263588,0.1203949,0.1629121,0.009871764,0.0003771965,0.01571922,0.003097718,0.0009767517,0.01696446,0.07975071,0.5864981],"study_design_scores_gemma":[0.00663544,0.004106219,0.197508,0.4980002,0.0180002,0.001060633,0.02204685,0.01305369,0.0051618,0.03837166,0.1946023,0.001452918],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"protocol","genre_gemma":"empirical","genre_scores_codex":[0.0780526,0.1533464,0.1567592,0.08718112,0.008326655,0.4491026,0.01869461,0.001771337,0.0467655],"genre_scores_gemma":[0.15813,0.02198893,0.6271245,0.005810956,0.0004309957,0.1786046,0.006873476,0.0001888721,0.0008475655],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.562421,"threshold_uncertainty_score":0.6935652,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.9308550065336542,"score_gpt":0.8065574799259807,"score_spread":0.1242975266076735,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}