{"id":"W4389524498","doi":"10.18653/v1/2023.emnlp-industry.26","title":"Unveiling Identity Biases in Toxicity Detection : A Game-Focused Dataset and Reactivity Analysis Approach","year":2023,"lang":"en","type":"article","venue":"","topic":"Hate Speech and Cyberbullying Detection","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University; Ubisoft (Canada)","funders":"Mitacs","keywords":"Computer science; Conversation; Identity (music); Harm; Class (philosophy); Benchmarking; Perspective (graphical); Artificial intelligence; Natural language processing; Machine learning; Psychology; Social psychology; Communication","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003979699,0.001335913,0.0005587403,0.002902323,0.001209215,0.001611525,0.001415722,0.002128856,0.001709386],"category_scores_gemma":[0.01463305,0.0002926541,0.001035016,0.001661999,0.0009905872,0.002351761,0.002478302,0.002363912,0.00202132],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001343308,"about_ca_system_score_gemma":0.001111382,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009504809,"about_ca_topic_score_gemma":0.02063714,"domain_scores_codex":[0.995325,0.001899883,0.0004076634,0.0009956533,0.00109418,0.0002775649],"domain_scores_gemma":[0.9906073,0.004511638,0.0007821262,0.001839969,0.001842761,0.0004162386],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002472556,0.003416439,0.3489628,0.002798088,0.0006158109,0.002005358,0.006968872,0.04271769,0.03765283,0.01864866,0.2892607,0.2444802],"study_design_scores_gemma":[0.0004107475,0.001551264,0.2331646,0.0004897552,0.0003640538,0.002447525,0.006694118,0.4118857,0.05393481,0.02526629,0.2632873,0.0005038389],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7189392,0.00216956,0.08129027,0.003086047,0.0007497367,0.001504257,0.1600309,0.01292556,0.01930444],"genre_scores_gemma":[0.7092544,0.0003773097,0.06252516,0.001372193,0.0001702687,0.001417866,0.2159944,0.000821229,0.008067068],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009504809,"threshold_uncertainty_score":0.02104688,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03807695971279029,"score_gpt":0.2792286478311847,"score_spread":0.2411516881183944,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}