{"id":"W4386208946","doi":"10.2196/48496","title":"A Comprehensive, Valid, and Reliable Tool to Assess the Degree of Responsibility of Digital Health Solutions That Operate With or Without Artificial Intelligence: 3-Phase Mixed Methods Study","year":2023,"lang":"en","type":"review","venue":"Journal of Medical Internet Research","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"Centre Hospitalier de l’Université de Montréal; Université de Montréal","funders":"Canadian Institutes of Health Research","keywords":"CLARITY; Delphi method; Inter-rater reliability; Reliability (semiconductor); Delphi; Digital health; Psychology; Computer science; Applied psychology; Artificial intelligence; Rating scale; Health care","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2116112,0.002399249,0.003798357,0.00577288,0.003183063,0.004368807,0.00360125,0.00349658,0.004457981],"category_scores_gemma":[0.1557895,0.002282222,0.00700116,0.005732184,0.002403924,0.004611643,0.006056787,0.002388251,0.0008430366],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005973995,"about_ca_system_score_gemma":0.02080578,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002053814,"about_ca_topic_score_gemma":0.004899137,"domain_scores_codex":[0.8571193,0.1086763,0.01388786,0.005916342,0.01177729,0.002622908],"domain_scores_gemma":[0.816729,0.1212872,0.01793771,0.01044055,0.03172557,0.001879984],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.01771527,0.03123458,0.08743786,0.06195353,0.005976633,0.0009408789,0.121466,0.006595497,0.009097776,0.01367874,0.006959348,0.6369439],"study_design_scores_gemma":[0.04181449,0.1863248,0.2614592,0.05804798,0.01706093,0.001632876,0.1968659,0.0507591,0.04110611,0.04655845,0.09590608,0.002464036],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"protocol","genre_gemma":"review","genre_scores_codex":[0.3080166,0.003015957,0.1113192,0.0008401309,0.0002358924,0.5708607,0.002103932,0.00015501,0.003452549],"genre_scores_gemma":[0.1854298,0.0009117217,0.2090843,0.0008979922,0.00006779955,0.6022149,0.0007723492,0.0000462967,0.0005748569],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.2116112,"threshold_uncertainty_score":0.9722238,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.860717626630618,"score_gpt":0.6915041917528214,"score_spread":0.1692134348777966,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}