{"id":"W3092614733","doi":"10.18653/v1/2020.findings-emnlp.195","title":"Participatory Research for Low-resourced Machine Translation: A Case Study in African Languages","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Machine translation; Citizen journalism; Scalability; Participatory action research; Process (computing); Artificial intelligence; Focus (optics); Diversity (politics); Data science; Translation (biology); Code (set theory); Languages of Africa; Natural language processing; World Wide Web; Political science; Sociology; Programming language; Linguistics; Set (abstract data type); Database","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002095504,0.0002661343,0.0004081367,0.0004528541,0.0001329924,0.0003547085,0.001575598,0.0001996453,0.00001449007],"category_scores_gemma":[0.000268034,0.0002301333,0.0000973374,0.0007334292,0.00006224569,0.0001527818,0.001347882,0.001238331,0.000004128662],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001186777,"about_ca_system_score_gemma":0.0002326066,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002677214,"about_ca_topic_score_gemma":0.002729763,"domain_scores_codex":[0.9969867,0.0005404956,0.0004546112,0.0009904261,0.0005579937,0.0004697065],"domain_scores_gemma":[0.9981008,0.0005273318,0.0001024787,0.0009350954,0.0001886269,0.0001457238],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004585801,0.003341742,0.003891082,0.003618496,0.000320037,0.05613011,0.3617655,0.0004930877,0.00225627,0.01700997,0.00407749,0.5466377],"study_design_scores_gemma":[0.003553801,0.001681523,0.0002621369,0.0006666433,0.00008305484,0.0004906469,0.02054154,0.8907278,0.009086256,0.06948023,0.001197164,0.002229203],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1314109,0.01093227,0.8341354,0.01176338,0.0002126526,0.007580988,0.00005420693,0.002713608,0.001196658],"genre_scores_gemma":[0.743013,0.000002081075,0.2560289,0.0001111832,0.00006335702,0.0006895465,0.000007551967,0.0000225179,0.00006182697],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.8902347,"threshold_uncertainty_score":0.9384563,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.24803139057706,"score_gpt":0.4603048529427606,"score_spread":0.2122734623657006,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}