{"id":"W4385573793","doi":"10.18653/v1/2022.emnlp-main.809","title":"Directions for NLP Practices Applied to Online Hate Speech Detection","year":2022,"lang":"en","type":"article","venue":"","topic":"Hate Speech and Cyberbullying Detection","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"Simon Fraser University","funders":"European Social Fund; Fundação para a Ciência e a Tecnologia; Ministério da Ciência, Tecnologia e Ensino Superior","keywords":"Computer science; Conceptualization; Task (project management); Artificial intelligence; Generalization; Natural language processing; Situated; Quality (philosophy); Epistemology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3157566,0.003100308,0.003518162,0.01410014,0.01025442,0.03850333,0.01471304,0.01333352,0.0097048],"category_scores_gemma":[0.4001643,0.003191413,0.00282645,0.0103828,0.03807309,0.07615594,0.01946735,0.02147624,0.005122179],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01422192,"about_ca_system_score_gemma":0.02137456,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01682231,"about_ca_topic_score_gemma":0.0126473,"domain_scores_codex":[0.7036076,0.2343382,0.01311151,0.023452,0.0232622,0.002228497],"domain_scores_gemma":[0.3847277,0.4462197,0.02377231,0.07722046,0.06230137,0.005758422],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001404409,0.0006967374,0.01739585,0.001487192,0.0001873005,0.0002778953,0.02136495,0.005152036,0.002369562,0.6117985,0.01296317,0.3261665],"study_design_scores_gemma":[0.00006849951,0.0001372015,0.003177817,0.001505972,0.00004996899,0.0003323189,0.01170006,0.02769787,0.002604286,0.9047993,0.04770492,0.0002218015],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.004819296,0.003912327,0.8934608,0.08510596,0.0005111489,0.0007155744,0.0002854946,0.001170658,0.0100187],"genre_scores_gemma":[0.0795592,0.002737353,0.9062955,0.004698634,0.001004952,0.002601571,0.0005094213,0.0004594171,0.002133931],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.3157566,"threshold_uncertainty_score":0.8437939,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02623330174149566,"score_gpt":0.2818900551993356,"score_spread":0.2556567534578399,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}