{"id":"W4307743453","doi":"10.37213/cjal.2022.32477","title":"A Corpus-Based Comparison of Syntactic Complexity in Spoken and Written Learner Language","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Applied Linguistics","topic":"EFL/ESL Teaching and Learning","field":"Arts and Humanities","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Sehan University","keywords":"Subordination (linguistics); Linguistics; Complement (music); Grammar; Computer science; Sentence; Dependent clause; Syntax; Consistency (knowledge bases); Natural language processing; Traditional grammar; Psychology; Artificial intelligence","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001247716,0.0001636026,0.0002668638,0.003679988,0.0006747497,0.0009221156,0.0002757462,0.0002403219,0.001983247],"category_scores_gemma":[0.006157414,0.0001250329,0.000165413,0.002314162,0.0006948579,0.0009524794,0.0009696933,0.0003284621,0.0003459167],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003879733,"about_ca_system_score_gemma":0.0006228894,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00265527,"about_ca_topic_score_gemma":0.007197927,"domain_scores_codex":[0.9990624,0.0003188455,0.0001772207,0.0002301078,0.0001788208,0.00003270403],"domain_scores_gemma":[0.9927306,0.004080277,0.0008996326,0.000684021,0.001333979,0.0002715399],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000508111,0.0005624058,0.7909735,0.0008265439,0.0001778706,0.0008386478,0.04811186,0.0003155479,0.03011384,0.001118662,0.001480798,0.1249722],"study_design_scores_gemma":[0.00002157082,0.0002086118,0.9731132,0.00006726738,0.00007481551,0.0009830118,0.01606545,0.000587173,0.004436841,0.0002240741,0.004183847,0.00003414743],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9971361,0.0001302263,0.0006646841,0.0000125094,0.000004607263,0.00003687113,0.0006558004,0.00001041949,0.001348707],"genre_scores_gemma":[0.9954359,0.0001588379,0.002195718,0.00001450996,0.000006021714,0.0001320715,0.001537556,0.00001610579,0.0005031055],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003679988,"threshold_uncertainty_score":0.006634653,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05788903137333364,"score_gpt":0.2768380237528634,"score_spread":0.2189489923795298,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}