{"id":"W4287829644","doi":"10.5281/zenodo.3693274","title":"ON THE RELEVANCE OF QUERY EXPANSION USING PARALLEL CORPORA AND WORD EMBEDDINGS TO BOOST TEXT DOCUMENT RETRIEVAL PRECISION","year":2020,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Relevance (law); Query expansion; Word (group theory); Information retrieval; Relevance feedback; Document retrieval; Natural language processing; Artificial intelligence; Mathematics; Image retrieval","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003042212,0.001165357,0.001149235,0.002351181,0.000505563,0.001362574,0.0006773669,0.00105437,0.002593392],"category_scores_gemma":[0.01874803,0.000338142,0.00051536,0.002119105,0.0006435626,0.003005994,0.001078524,0.0008184466,0.001832077],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005280172,"about_ca_system_score_gemma":0.0007258118,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002556996,"about_ca_topic_score_gemma":0.002740824,"domain_scores_codex":[0.9975451,0.001005952,0.0001578566,0.0005020783,0.0006408131,0.0001482993],"domain_scores_gemma":[0.9926086,0.005026032,0.0002800449,0.0007631077,0.001234155,0.00008794123],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00157327,0.0006149123,0.004179006,0.0009666607,0.0002396101,0.0002131899,0.0003198446,0.05765439,0.09550299,0.004138432,0.01199675,0.822601],"study_design_scores_gemma":[0.0004582385,0.001501239,0.01115535,0.0001585368,0.0005527159,0.000915524,0.0003286458,0.823877,0.1309392,0.01267641,0.01728324,0.0001538377],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.4999086,0.01655752,0.4537657,0.001350607,0.0007596283,0.0005893719,0.0009184194,0.008919451,0.01723066],"genre_scores_gemma":[0.7574719,0.003053314,0.229699,0.000302781,0.000507699,0.0002461378,0.001559735,0.0008022538,0.006357145],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.003042212,"threshold_uncertainty_score":0.0160889,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03762505963033836,"score_gpt":0.2720517554135033,"score_spread":0.2344266957831649,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}