{"id":"W2888230820","doi":"10.5539/ijel.v8n5p297","title":"Prevalence of Prefabricated Structures in Academic Discourse: A Corpus-Based Study","year":2018,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Discourse Analysis in Language Studies","field":"Arts and Humanities","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Linguistics; Discipline; Phrase; Lexical item; Context (archaeology); Lexical density; Computer science; Variation (astronomy); Taxonomy (biology); Natural language processing; Corpus linguistics; Artificial intelligence; Sociology; History; Biology; Social science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003828961,0.0002253145,0.0005536933,0.01065537,0.002039682,0.003172455,0.0005941837,0.000693936,0.002034426],"category_scores_gemma":[0.02404104,0.0003483533,0.0002579589,0.01281317,0.002394298,0.002999089,0.002724265,0.0007699402,0.0003894806],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00125909,"about_ca_system_score_gemma":0.001369577,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004575109,"about_ca_topic_score_gemma":0.009662534,"domain_scores_codex":[0.9958583,0.001680728,0.0007833284,0.0007466977,0.0007687045,0.0001623635],"domain_scores_gemma":[0.9739062,0.01757763,0.004140052,0.001257145,0.002603859,0.0005151876],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0004361908,0.00076319,0.4810722,0.004654736,0.0002129356,0.00226459,0.3931074,0.0003220503,0.009924071,0.005691356,0.004666034,0.09688519],"study_design_scores_gemma":[0.00004715462,0.000242669,0.7527912,0.001269659,0.0002492278,0.00338641,0.1989854,0.00187945,0.003091622,0.001211365,0.03674814,0.00009766463],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9943563,0.001205259,0.0006945013,0.0001420231,0.00001597052,0.0001300023,0.001167846,0.00001024213,0.002277799],"genre_scores_gemma":[0.992815,0.001394553,0.002637835,0.00006068973,0.00002545726,0.0003597344,0.002200795,0.00002138016,0.0004845603],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01065537,"threshold_uncertainty_score":0.02024972,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03158774037446115,"score_gpt":0.3462397780221272,"score_spread":0.3146520376476661,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}