{"id":"W2145908128","doi":"10.48550/arxiv.1412.6448","title":"Embedding Word Similarity with Neural Machine Translation","year":2014,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Topic Modeling","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Embedding; Natural language processing; Similarity (geometry); Machine translation; Artificial intelligence; Word (group theory); Word embedding; Translation (biology); Vocabulary; Example-based machine translation; German; Class (philosophy); Function (biology); Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001213819,0.0008396067,0.0008062138,0.001079062,0.0003479202,0.001141028,0.001020911,0.001209321,0.00254303],"category_scores_gemma":[0.01026396,0.0004548697,0.0008377507,0.001687401,0.0008033063,0.003717932,0.001669152,0.001512413,0.0009223959],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008866739,"about_ca_system_score_gemma":0.0005642438,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002549865,"about_ca_topic_score_gemma":0.002810257,"domain_scores_codex":[0.9991541,0.0004334964,0.0000538052,0.0001997234,0.0001157649,0.00004306797],"domain_scores_gemma":[0.9976155,0.001482254,0.0002256895,0.0003808505,0.0002456982,0.00005002852],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001949073,0.0001396893,0.00195978,0.0002551711,0.0001638661,0.0001339498,0.0002220801,0.6668756,0.002881245,0.06807817,0.003607256,0.2554884],"study_design_scores_gemma":[0.000008256129,0.00001934482,0.0001315623,0.000008034744,0.000008357737,0.00001837678,0.00001288343,0.9446552,0.0005579368,0.05396849,0.0006042884,0.000007302718],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05859415,0.0008312275,0.9358972,0.000541203,0.0001011107,0.00006441269,0.0002585475,0.0009112188,0.002801005],"genre_scores_gemma":[0.7704972,0.000712186,0.2202961,0.0002213297,0.0002040467,0.0002731641,0.001104979,0.0002412017,0.006449697],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002549865,"threshold_uncertainty_score":0.008507311,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08227646160660891,"score_gpt":0.1993835748629519,"score_spread":0.117107113256343,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}