{"id":"W3120950293","doi":"10.18653/v1/2020.aacl-srw.14","title":"Training with Adversaries to Improve Faithfulness of Attention in Neural Machine Translation","year":2020,"lang":"en","type":"article","venue":"","topic":"Topic Modeling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Machine translation; Computer science; Regularization (linguistics); Measure (data warehouse); Translation (biology); Divergence (linguistics); Artificial intelligence; Differentiable function; Machine learning; Quality (philosophy); Trustworthiness; Language model; Natural language processing; Mathematics; Data mining","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00007110421,0.00005469221,0.00009361567,0.00004258264,0.00001448952,0.00002100749,0.0001750758,0.000016225,0.000005083381],"category_scores_gemma":[0.000008139014,0.00004455249,0.0000160479,0.0002364285,0.000007733653,0.0003113282,0.00002830731,0.00005265517,0.000001128795],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000006606281,"about_ca_system_score_gemma":0.00001836673,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00009608593,"about_ca_topic_score_gemma":0.0001324965,"domain_scores_codex":[0.9994339,0.00001689267,0.0001429602,0.0001889938,0.0001218363,0.00009546537],"domain_scores_gemma":[0.9997906,0.00001657071,0.00002825705,0.0001038771,0.00001919154,0.00004152299],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000431291,0.00001361599,0.002597588,0.00003410538,0.000005583103,0.000004795707,0.01519441,0.03352119,0.005934702,0.005273855,0.000002058185,0.9373749],"study_design_scores_gemma":[0.0003342733,0.00009937108,0.002538271,0.000008436709,0.000001643131,8.712289e-7,0.0002377865,0.9956582,0.0009717353,0.00006559901,0.00002242335,0.00006143752],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1712062,0.0000151669,0.8247186,0.003488708,0.00003508636,0.0001043421,6.501975e-7,0.0000401112,0.0003911803],"genre_scores_gemma":[0.9283977,1.053961e-7,0.07128721,0.000283766,0.00001299529,0.00000435545,8.279247e-7,0.000002790171,0.00001024352],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.962137,"threshold_uncertainty_score":0.1816798,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04479434594496593,"score_gpt":0.2456234107420521,"score_spread":0.2008290647970862,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}