{"id":"W3186243414","doi":"10.2196/29584","title":"Categorizing Vaccine Confidence With a Transformer-Based Machine Learning Model: Analysis of Nuances of Vaccine Sentiment in Twitter Discourse","year":2021,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Vaccine Coverage and Hesitancy","field":"Social Sciences","cited_by":37,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"European Commission; Horizon 2020 Framework Programme; GlaxoSmithKline","keywords":"Social media; Artificial intelligence; Computer science; Machine learning; Psychological intervention; Natural language processing; Sentiment analysis; Annotation; Set (abstract data type); Test set; Information retrieval; World Wide Web; Medicine; Nursing","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000702256,0.0001372741,0.0005781123,0.0002859192,0.00008772303,0.0000227481,0.0002273297,0.000109126,0.000818026],"category_scores_gemma":[0.000114772,0.0001053231,0.0001301767,0.001509837,0.00003537639,0.0003427828,0.00002229296,0.0002948338,0.00000174877],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005069378,"about_ca_system_score_gemma":0.0006337857,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006579063,"about_ca_topic_score_gemma":0.005835998,"domain_scores_codex":[0.997646,0.00008867349,0.0008636906,0.0001120735,0.0009952515,0.0002942686],"domain_scores_gemma":[0.9989812,0.0001658582,0.0003201492,0.0001740887,0.0001973587,0.0001613311],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005060215,0.0013028,0.5946569,0.001317112,0.001335415,0.0001417097,0.2711299,0.1084322,0.0004054357,0.007277026,0.0004437436,0.01305173],"study_design_scores_gemma":[0.003163546,0.0002294835,0.01190248,0.0005011066,0.0006545112,0.000002825942,0.03981638,0.9402611,0.00234533,0.0002131355,0.0005650554,0.0003450873],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9470505,0.0002292078,0.04800996,0.002373258,0.00002744135,0.0002273476,0.000008391824,0.00002325151,0.002050661],"genre_scores_gemma":[0.9981657,0.0002234018,0.001081736,0.0003181233,0.00002175056,0.00001691297,0.00004429738,0.000007009964,0.0001211168],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.8318288,"threshold_uncertainty_score":0.895681,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01875867115867625,"score_gpt":0.331647384747175,"score_spread":0.3128887135884987,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}