{"id":"W2507532992","doi":"10.18653/v1/w16-1817","title":"A Word Embedding Approach to Identifying Verb-Noun Idiomatic Combinations","year":2016,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":23,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of New Brunswick","funders":"Natural Sciences and Engineering Research Council of Canada; New Brunswick Innovation Foundation","keywords":"Noun; Verb; Linguistics; Computer science; Natural language processing; Artificial intelligence; Embedding; Word (group theory); Word embedding; Philosophy","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007973771,0.001115654,0.0005857163,0.002957751,0.0006629009,0.001173345,0.0009824749,0.0009535617,0.0024033],"category_scores_gemma":[0.00301738,0.000362565,0.0007532789,0.002387186,0.0006759997,0.002905902,0.001353215,0.001436659,0.001343982],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000388934,"about_ca_system_score_gemma":0.0008975549,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001571813,"about_ca_topic_score_gemma":0.004171571,"domain_scores_codex":[0.9987587,0.0003815201,0.0001485109,0.0004221899,0.0002194271,0.00006977653],"domain_scores_gemma":[0.9978839,0.0008695151,0.0002429177,0.0003683235,0.0005592031,0.00007613176],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002530318,0.0006369422,0.006874552,0.0005048293,0.0002430361,0.0003183839,0.0008117915,0.01205916,0.04637151,0.02447547,0.009930241,0.8975211],"study_design_scores_gemma":[0.00007460175,0.0004070638,0.009870641,0.0001343718,0.0002099065,0.00140647,0.001116478,0.8436574,0.0405229,0.07553824,0.02690362,0.0001583385],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0471441,0.0005245176,0.9450674,0.0003004102,0.0001362708,0.0003117974,0.00120325,0.002137189,0.003175112],"genre_scores_gemma":[0.2485262,0.000351384,0.7428104,0.0001530444,0.00009921697,0.0003455428,0.003319749,0.0002661286,0.004128293],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002957751,"threshold_uncertainty_score":0.008039832,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02556238856448056,"score_gpt":0.3030429286356068,"score_spread":0.2774805400711263,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}