{"id":"W4403913043","doi":"10.2196/60939","title":"Ensuring Accuracy and Equity in Vaccination Information From ChatGPT and CDC: Mixed-Methods Cross-Language Evaluation","year":2024,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":17,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Readability; Misinformation; Health care; Equity (law); Health equity; Medical education; Psychology; Family medicine; Public health; Computer science; Medicine; Political science; Nursing","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2827615,0.001530686,0.00228749,0.003714876,0.002513906,0.004170411,0.002398318,0.002452998,0.003536332],"category_scores_gemma":[0.2932555,0.001423778,0.004828665,0.002733229,0.002193777,0.004929401,0.005303874,0.001830069,0.0006288427],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008845164,"about_ca_system_score_gemma":0.01281459,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006575126,"about_ca_topic_score_gemma":0.008361671,"domain_scores_codex":[0.7269645,0.2269129,0.02008584,0.005932032,0.01682581,0.003278914],"domain_scores_gemma":[0.636794,0.2541765,0.02637878,0.01677664,0.06044997,0.005424108],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.06075836,0.05890405,0.2815831,0.02310113,0.00792053,0.0008281761,0.1475526,0.002985731,0.003308605,0.00374129,0.003478925,0.4058376],"study_design_scores_gemma":[0.03720534,0.2847477,0.4623992,0.02012086,0.01366551,0.0009244239,0.1074783,0.01923397,0.02171783,0.007591707,0.02385456,0.001060555],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8945954,0.002081439,0.01640484,0.0006528675,0.0002142808,0.08010943,0.001296917,0.0001109854,0.004533917],"genre_scores_gemma":[0.8015461,0.001258009,0.04367752,0.001056288,0.0001265167,0.1503839,0.0009043573,0.00004775603,0.0009995804],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.2827615,"threshold_uncertainty_score":0.8844827,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.308937529224162,"score_gpt":0.6684390935921213,"score_spread":0.3595015643679593,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}