{"id":"W4385573366","doi":"10.18653/v1/2022.wanlp-1.9","title":"NADI 2022: The Third Nuanced Arabic Dialect Identification Shared Task","year":2022,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":54,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"Alliance de recherche numérique du Canada; Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Georgetown University","keywords":"Arabic; Task (project management); Identification (biology); Context (archaeology); Computer science; Natural language processing; Linguistics; Artificial intelligence; History; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01200697,0.002617802,0.002242046,0.002416791,0.003394597,0.004306696,0.003190388,0.003233745,0.01165298],"category_scores_gemma":[0.02420792,0.0005925428,0.001934094,0.0016736,0.00117003,0.004187935,0.01278882,0.00488618,0.01219651],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001876335,"about_ca_system_score_gemma":0.00479653,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01071224,"about_ca_topic_score_gemma":0.01844407,"domain_scores_codex":[0.9888205,0.004890483,0.0006504374,0.002550235,0.002024433,0.00106394],"domain_scores_gemma":[0.982679,0.005723555,0.0005514916,0.004040933,0.003562464,0.003442534],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"observational","study_design_scores_codex":[0.004243729,0.003802418,0.02916624,0.003256006,0.0008375367,0.00197872,0.01337929,0.009555506,0.0547509,0.005971174,0.531178,0.3418805],"study_design_scores_gemma":[0.002212155,0.003155003,0.07259126,0.0006171851,0.0004567066,0.003137667,0.01955902,0.09305774,0.04481161,0.02470171,0.7349071,0.0007928064],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5448121,0.004536175,0.1484837,0.008771071,0.007139274,0.009934817,0.1526094,0.0312929,0.0924205],"genre_scores_gemma":[0.4427426,0.0004239024,0.2428093,0.003427488,0.0009944995,0.009538806,0.2573059,0.00366466,0.03909285],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01200697,"threshold_uncertainty_score":0.06349969,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01098847831328417,"score_gpt":0.2539559427230517,"score_spread":0.2429674644097675,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}