{"id":"W4412822443","doi":"10.1001/jamanetworkopen.2025.30220","title":"Reporting Guideline for Chatbot Health Advice Studies","year":2025,"lang":"en","type":"article","venue":"JAMA Network Open","topic":"Digital Mental Health Interventions","field":"Psychology","cited_by":21,"is_retracted":false,"has_abstract":true,"ca_institutions":"Ottawa Hospital; University of British Columbia; McMaster University; Women's College Hospital; Hamilton Health Sciences; University of Toronto","funders":"","keywords":"Checklist; Computer science; Guideline; Interpretability; Data science; Medicine; Psychology; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"},{"model":"gpt","categories":["metaresearch"],"domain":"reporting","study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high","status":"direct model label, unvalidated"}],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4783544,0.004803658,0.008663458,0.03936803,0.005368099,0.01706034,0.01583176,0.0156831,0.0164328],"category_scores_gemma":[0.7430884,0.007494536,0.01883884,0.03052252,0.007134418,0.01209265,0.01250933,0.01389187,0.01284865],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0160488,"about_ca_system_score_gemma":0.06825872,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01008237,"about_ca_topic_score_gemma":0.009583026,"domain_scores_codex":[0.23574,0.3469997,0.3708146,0.006913722,0.03603416,0.003497794],"domain_scores_gemma":[0.1144873,0.4849604,0.1166181,0.04907071,0.2309694,0.003894212],"domain_codex":"reporting","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":"reporting","study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001144613,0.0002914437,0.004196993,0.3055521,0.002068866,0.0008870942,0.01094312,0.002109989,0.002309131,0.01811909,0.4458207,0.2065569],"study_design_scores_gemma":[0.002214342,0.0005176694,0.005742223,0.4288789,0.002403827,0.0008683489,0.00569714,0.002875465,0.003536427,0.02005442,0.5266856,0.0005255631],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"protocol","genre_gemma":"methods","genre_scores_codex":[0.003579147,0.03613101,0.2682837,0.0731429,0.01934639,0.499458,0.06128138,0.009195269,0.02958227],"genre_scores_gemma":[0.007159378,0.01274125,0.4457197,0.009724676,0.001043303,0.5065299,0.01313318,0.0008669167,0.003081722],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.5216457,"threshold_uncertainty_score":0.6432819,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1735591945722361,"score_gpt":0.5589418649843204,"score_spread":0.3853826704120843,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}