{"id":"W4415406762","doi":"10.1136/bmjebm-2025-113675","title":"Comparing traditional and AI-enhanced strategies for developing patient decision aids: a multiple case study","year":2025,"lang":"en","type":"article","venue":"BMJ evidence-based medicine","topic":"Healthcare Decision-Making and Restraints","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université Laval","funders":"","keywords":"Context (archaeology); Key (lock); Data collection; Identification (biology)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"qualitative","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"},{"model":"gpt","categories":[],"domain":null,"study_design":"design_other","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09077914,0.0009472228,0.001025153,0.003685764,0.005208706,0.004155736,0.003431632,0.002927166,0.002831786],"category_scores_gemma":[0.1536218,0.0008442735,0.001357449,0.002557724,0.004571776,0.00674498,0.00658023,0.002852177,0.0003302141],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0107329,"about_ca_system_score_gemma":0.008323847,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00243628,"about_ca_topic_score_gemma":0.005822843,"domain_scores_codex":[0.8739438,0.1100652,0.005675076,0.002009541,0.005938095,0.002368242],"domain_scores_gemma":[0.8114017,0.1644788,0.009175586,0.004816706,0.007241112,0.002886022],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"qualitative","study_design_scores_codex":[0.002626751,0.01225861,0.06248174,0.008276203,0.000387942,0.01342634,0.6154959,0.00311224,0.00242719,0.01864081,0.003739424,0.2571269],"study_design_scores_gemma":[0.00376877,0.02535821,0.03200256,0.01062988,0.0007229274,0.01679653,0.7954669,0.0133087,0.01424282,0.01493271,0.07222369,0.0005464205],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9680127,0.001445786,0.01413505,0.002744217,0.00008528809,0.006805365,0.000133709,0.00003252774,0.006605378],"genre_scores_gemma":[0.9265456,0.001488293,0.06234985,0.0007493085,0.0000444402,0.007794051,0.00006866707,0.00002499763,0.0009349241],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.09077914,"threshold_uncertainty_score":0.4800917,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.249720380701134,"score_gpt":0.478647880144518,"score_spread":0.228927499443384,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}