{"id":"W1828724394","doi":"10.48550/arxiv.1410.2455","title":"BilBOWA: Fast Bilingual Distributed Representations without Word Alignments","year":2014,"lang":"en","type":"article","venue":"arXiv (Cornell University)","topic":"Topic Modeling","field":"Computer Science","cited_by":314,"is_retracted":false,"has_abstract":true,"ca_institutions":"Université de Montréal; Canadian Institute for Advanced Research","funders":"","keywords":"Computer science; Natural language processing; Artificial intelligence; Task (project management); Word (group theory); Bilingual dictionary; Sentence; Feature (linguistics); Set (abstract data type); Machine translation; Translation (biology); Speech recognition; Linguistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001423148,0.001579095,0.001329589,0.001414354,0.0006224874,0.001489254,0.002293299,0.001105908,0.006139134],"category_scores_gemma":[0.00438692,0.0006792836,0.00115888,0.001902235,0.0005303894,0.003994748,0.003399884,0.00231312,0.007450167],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006179924,"about_ca_system_score_gemma":0.001758224,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003571508,"about_ca_topic_score_gemma":0.00664028,"domain_scores_codex":[0.9991549,0.0002739545,0.00004692126,0.0002794465,0.0001474419,0.000097322],"domain_scores_gemma":[0.9991197,0.0002364443,0.00007184264,0.0003450045,0.0001507128,0.00007641689],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000584359,0.0004473462,0.002567116,0.0002916734,0.0002427283,0.0001606861,0.0002838374,0.08080888,0.0144467,0.02349649,0.04621321,0.8304571],"study_design_scores_gemma":[0.00008670871,0.0001339271,0.0005172955,0.00003189188,0.00003804093,0.0001293184,0.00008422535,0.9384073,0.006106061,0.04155922,0.01286743,0.00003861929],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01702086,0.0005784828,0.9694914,0.0002666806,0.0001847987,0.0001025871,0.001469337,0.009184909,0.001700857],"genre_scores_gemma":[0.2696638,0.0007109785,0.6981762,0.0005450118,0.0002919687,0.0008935911,0.01769568,0.001955802,0.01006704],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006139134,"threshold_uncertainty_score":0.02053744,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0557204607827267,"score_gpt":0.2038580054545029,"score_spread":0.1481375446717763,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}