{"id":"W2964145186","doi":"10.26615/978-954-452-049-6_027","title":"Automatic Identification of AltLexes using Monolingual Parallel Corpora","year":2017,"lang":"en","type":"article","venue":"","topic":"Text Readability and Simplification","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Natural language processing; WordNet; Leverage (statistics); Artificial intelligence; Parsing; Text simplification; Identification (biology); Task (project management); Natural language; Parallel corpora; Relation (database); Simple (philosophy); Sentence; Machine translation; Database","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002958436,0.001555759,0.001024277,0.01139358,0.00203473,0.003270818,0.00121655,0.0009477039,0.009272437],"category_scores_gemma":[0.01762319,0.0009340397,0.0006684109,0.005782645,0.001144515,0.006187396,0.003391957,0.001797146,0.004353184],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009395097,"about_ca_system_score_gemma":0.001824759,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002343601,"about_ca_topic_score_gemma":0.004626263,"domain_scores_codex":[0.9952366,0.001036425,0.0006720336,0.0020063,0.000844246,0.0002044246],"domain_scores_gemma":[0.9813168,0.008730159,0.002060269,0.00280907,0.004483069,0.0006006256],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007437485,0.0006534896,0.03045393,0.00350617,0.000330048,0.006767737,0.008174148,0.003762549,0.1790535,0.02065786,0.03694945,0.7089475],"study_design_scores_gemma":[0.0004696372,0.0005045477,0.09785706,0.000975656,0.0008470509,0.009932856,0.012518,0.1325168,0.2149758,0.05568178,0.4731625,0.0005584134],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.4802736,0.004281629,0.4222071,0.001094862,0.0008149748,0.001497098,0.02488663,0.0182738,0.04667038],"genre_scores_gemma":[0.4912134,0.001680506,0.4341649,0.0002480469,0.000385935,0.001336085,0.05865155,0.002625034,0.009694562],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01139358,"threshold_uncertainty_score":0.03101933,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05978571800230753,"score_gpt":0.3233308221855031,"score_spread":0.2635451041831955,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}