{"id":"W2900029582","doi":"10.22215/etd/2018-13317","title":"Disregarding Linguistics: A Critical Study of Google Translate's Syntactic/Semantic Errors in Rendering Multiword Units in English to Persian Translations","year":2018,"lang":"en","type":"dissertation","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"","keywords":"Computer science; Natural language processing; Machine translation; Persian; Artificial intelligence; Rendering (computer graphics); Linguistics; Source text; Corpus linguistics; Rule-based machine translation","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0130657,0.000380748,0.0003522149,0.004118833,0.00373638,0.003850208,0.0006996652,0.0008073774,0.001118798],"category_scores_gemma":[0.08244186,0.0003860334,0.0002044046,0.005091077,0.00561394,0.003778089,0.001706899,0.00154437,0.0004665507],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002673773,"about_ca_system_score_gemma":0.003320652,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01480865,"about_ca_topic_score_gemma":0.02589177,"domain_scores_codex":[0.9888206,0.005937405,0.0009222967,0.0008098983,0.003168897,0.0003409249],"domain_scores_gemma":[0.8861027,0.0865295,0.004859388,0.003329962,0.01880767,0.000370813],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"observational","study_design_scores_codex":[0.0006394067,0.0001910395,0.05003246,0.002397671,0.00005474069,0.005248835,0.5687976,0.00133442,0.01607526,0.02296185,0.01603922,0.3162275],"study_design_scores_gemma":[0.0000716557,0.0006456638,0.1619237,0.002003218,0.0002569226,0.009670094,0.435163,0.007561785,0.0745772,0.0175923,0.2902977,0.0002368033],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9575394,0.003546364,0.008089044,0.008054685,0.0003426345,0.0002006237,0.0003323795,0.0001988581,0.02169593],"genre_scores_gemma":[0.9836798,0.001979395,0.009367545,0.001283301,0.0001448049,0.00006864205,0.0003179084,0.0004006886,0.002757918],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01480865,"threshold_uncertainty_score":0.06909883,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02554117606792713,"score_gpt":0.342479134050637,"score_spread":0.3169379579827099,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}