{"id":"W2948877201","doi":"10.18653/v1/s19-2136","title":"UBC-NLP at SemEval-2019 Task 6: Ensemble Learning of Offensive Content With Enhanced Training Data","year":2019,"lang":"en","type":"preprint","venue":"","topic":"Hate Speech and Cyberbullying Detection","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary; University of British Columbia","funders":"","keywords":"SemEval; Offensive; Task (project management); Macro; Computer science; Artificial intelligence; Natural language processing; Ensemble learning; Machine learning; Training set; Host (biology); Mathematics; Operations research; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0006776674,0.0004213206,0.0007201394,0.0001790363,0.0001391921,0.0001647971,0.002110146,0.0002865891,0.00005755985],"category_scores_gemma":[0.0001295578,0.0003451134,0.0001218883,0.0002129273,0.00007345179,0.0002989552,0.004208933,0.0008139448,0.0002484841],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001234173,"about_ca_system_score_gemma":0.0004165556,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000589132,"about_ca_topic_score_gemma":0.0001309451,"domain_scores_codex":[0.996622,0.0001859789,0.0005199104,0.001464724,0.0006874731,0.000519861],"domain_scores_gemma":[0.9959731,0.0001794024,0.0006561123,0.002638812,0.0004135775,0.000139038],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0005946059,0.0002588208,0.000760929,0.001037436,0.001448704,0.0001285794,0.01421848,0.0419255,0.6212429,0.002111431,0.01128865,0.3049839],"study_design_scores_gemma":[0.004307231,0.003268492,0.001607755,0.002786455,0.0003066299,0.0002509386,0.003055835,0.2616462,0.6976761,0.000496887,0.02133396,0.003263524],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2014198,0.0001754633,0.7830971,0.0001988545,0.001060495,0.0006846318,0.0000312642,0.0003162596,0.01301602],"genre_scores_gemma":[0.9474483,0.00008078062,0.02721385,0.0001302176,0.0001001076,0.00001709388,0.0002331129,0.00004057794,0.02473598],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7558833,"threshold_uncertainty_score":0.9999001,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07137152691733431,"score_gpt":0.2596168888994028,"score_spread":0.1882453619820685,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}