{"id":"W2100664567","doi":"10.3115/v1/p15-1001","title":"On Using Very Large Target Vocabulary for Neural Machine Translation","year":2015,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":872,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"Samsung; Compute Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canadian Institute for Advanced Research","keywords":"Machine translation; Computer science; Vocabulary; Artificial intelligence; Natural language processing; Joint (building); Computational linguistics; Artificial neural network; Translation (biology); Volume (thermodynamics); Association (psychology); Speech recognition; Linguistics; Engineering; Philosophy","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003357789,0.001423357,0.001927944,0.003078663,0.001615439,0.002442612,0.002458054,0.002208272,0.01161907],"category_scores_gemma":[0.01218917,0.0006996281,0.001082063,0.003772133,0.001067747,0.008043237,0.004609047,0.002233578,0.01235754],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006161327,"about_ca_system_score_gemma":0.001407983,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006006271,"about_ca_topic_score_gemma":0.01158081,"domain_scores_codex":[0.9962769,0.001849632,0.0003828319,0.0006921433,0.0005176926,0.0002808275],"domain_scores_gemma":[0.9932014,0.003157453,0.0001695791,0.001922007,0.0014254,0.0001241197],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007984407,0.0002790658,0.0006808732,0.0004699129,0.0001891027,0.0003266245,0.0002991986,0.01970365,0.02048291,0.01729874,0.04165705,0.8978143],"study_design_scores_gemma":[0.0003776927,0.0004448215,0.0009117157,0.0001553388,0.0002299777,0.0005572947,0.0006631027,0.7870588,0.02743982,0.143152,0.03889208,0.0001174417],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03900882,0.005613179,0.9169099,0.001486488,0.001407467,0.000416482,0.0018595,0.01500016,0.01829795],"genre_scores_gemma":[0.3509439,0.002708737,0.6162224,0.00141867,0.000823477,0.000709094,0.01142039,0.001762772,0.01399056],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01161907,"threshold_uncertainty_score":0.03886962,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04490222195020935,"score_gpt":0.312351224200445,"score_spread":0.2674490022502356,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}