{"id":"W4318669789","doi":"10.2196/43007","title":"Voice Assistants’ Responses to Questions About the COVID-19 Vaccine: National Cross-sectional Study","year":2023,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"AI in Service Interactions","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"School of Medicine, Stanford University","keywords":"Misinformation; Test (biology); Cross-sectional study; Medicine; Family medicine; Psychology; Computer science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["sts","scholarly_communication","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006794423,0.0001582798,0.0001335735,0.001064663,0.002618349,0.001186898,0.002155949,0.00007163187,0.0001619799],"category_scores_gemma":[0.003172171,0.0001189998,0.00008222026,0.005054176,0.0001199562,0.001572257,0.001422956,0.0008518346,0.005673099],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000948778,"about_ca_system_score_gemma":0.001102367,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000366321,"about_ca_topic_score_gemma":0.00052901,"domain_scores_codex":[0.9944666,0.001350422,0.0004880686,0.0004853067,0.002581916,0.0006276783],"domain_scores_gemma":[0.9910248,0.00578447,0.00009641311,0.0007222659,0.0020408,0.0003312542],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.0005862435,0.001552359,0.3171392,0.00008789694,0.0002470662,0.00008141359,0.08806276,0.004314823,0.0004381365,0.0880024,0.4984131,0.001074626],"study_design_scores_gemma":[0.0003472559,0.000297564,0.932458,0.0000103195,0.000001004974,0.00003647923,0.002235,0.007004096,0.00002243987,0.004714584,0.05273866,0.0001345691],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9214804,0.00002099285,0.0285605,0.04046791,0.001221099,0.002146409,0.0002328396,0.0007917013,0.005078104],"genre_scores_gemma":[0.9930236,0.000005207414,0.0003658702,0.001198562,0.0001776773,0.001058822,0.00001488712,0.00001471967,0.004140629],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6153188,"threshold_uncertainty_score":0.99985,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1756690864710606,"score_gpt":0.5322474141646798,"score_spread":0.3565783276936192,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}