{"id":"W2467186984","doi":"10.18653/v1/s15-2078","title":"SemEval-2015 Task 10: Sentiment Analysis in Twitter","year":2015,"lang":"en","type":"article","venue":"","topic":"Sentiment Analysis and Opinion Mining","field":"Computer Science","cited_by":367,"is_retracted":false,"has_abstract":true,"ca_institutions":"National Research Council Canada","funders":"National Research Council Canada","keywords":"SemEval; Sentiment analysis; Computer science; Task (project management); Context (archaeology); Phrase; Polarity (international relations); Natural language processing; Set (abstract data type); Artificial intelligence; History","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005385806,0.004058355,0.001585819,0.002563649,0.002272058,0.003035622,0.002199928,0.002942943,0.01138386],"category_scores_gemma":[0.01404767,0.0005384907,0.002286937,0.001874299,0.0006723032,0.004020576,0.004572946,0.002807454,0.01427697],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001704293,"about_ca_system_score_gemma":0.002342082,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006315813,"about_ca_topic_score_gemma":0.02087009,"domain_scores_codex":[0.995087,0.002174644,0.0003833684,0.0009882402,0.0008520276,0.0005147053],"domain_scores_gemma":[0.9941889,0.002692089,0.0003533454,0.0008882301,0.001259213,0.0006182275],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.001427455,0.001077739,0.0114847,0.001693986,0.0004622545,0.0006474751,0.0009966214,0.004879272,0.01642088,0.00252211,0.746649,0.2117383],"study_design_scores_gemma":[0.001173929,0.001871263,0.04882609,0.0005437852,0.0004265097,0.001697859,0.003642272,0.2289357,0.05319828,0.01880262,0.6404085,0.0004731986],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.3299616,0.008051025,0.1846885,0.00819768,0.01012148,0.006105721,0.3019909,0.08519627,0.06568688],"genre_scores_gemma":[0.2739925,0.0009990304,0.2200867,0.002443251,0.001499306,0.004511158,0.4569819,0.004524003,0.03496218],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01138386,"threshold_uncertainty_score":0.03808284,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04611232732077405,"score_gpt":0.3102190803927146,"score_spread":0.2641067530719405,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}