{"id":"W3163248277","doi":"10.1177/0272989x211011120","title":"Are We Improving? Update and Critical Appraisal of the Reporting of Decision Process and Quality Measures in Trials Evaluating Patient Decision Aids","year":2021,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Patient-Provider Communication in Healthcare","field":"Health Professions","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"","keywords":"Decision aids; Medicine; Interpretability; Concordance; Reliability (semiconductor); Systematic review; MEDLINE; Critical appraisal; Randomized controlled trial; Alternative medicine; Computer science; Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02308885,0.0002516955,0.001433911,0.0002323089,0.0005651963,0.00002624491,0.0005095839,0.0005006206,0.0001414106],"category_scores_gemma":[0.7213465,0.0001715167,0.0001580416,0.0008100781,0.0003324626,0.0001953048,0.00169549,0.001325777,0.000001493476],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001501798,"about_ca_system_score_gemma":0.001485417,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001066205,"about_ca_topic_score_gemma":0.0005680757,"domain_scores_codex":[0.979451,0.006849675,0.009088974,0.0007380435,0.003361204,0.0005111218],"domain_scores_gemma":[0.7980827,0.1775135,0.01638317,0.002875052,0.004469923,0.0006756368],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0005111954,0.0001066527,0.239502,0.0009105064,0.000009323728,0.00001521719,0.004334655,0.00002931617,0.0002553443,0.0004782565,0.00006031583,0.7537872],"study_design_scores_gemma":[0.01018677,0.0007075965,0.6174429,0.1077065,0.0002125012,0.0001125458,0.09957878,0.03571165,0.001347578,0.1245155,0.001474242,0.001003435],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9705011,0.008443201,0.01679682,0.001741793,0.001551026,0.0008620122,0.00002404352,0.0000271728,0.00005285492],"genre_scores_gemma":[0.9626852,0.0002823662,0.03634327,0.0004878814,0.00007016806,0.00009811632,0.000002979438,0.00002815787,0.00000188246],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7527838,"threshold_uncertainty_score":0.800218,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4989277977698346,"score_gpt":0.607310710316577,"score_spread":0.1083829125467424,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}