{"id":"W1973560518","doi":"10.15398/jlm.v1i2.69","title":"Grammatical typology and frequency analysis: number availability and number use","year":2013,"lang":"en","type":"article","venue":"Journal of Language Modelling","topic":"Syntax, Semantics, Linguistic Variation","field":"Arts and Humanities","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Economic and Social Research Council","keywords":"Animacy; Plural; Hierarchy; Typology; Noun; Linguistics; Preference; Mathematics; Noun phrase; Linguistic typology; Correspondence analysis; Computer science; Statistics; Geography; Economics; Philosophy","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002770555,0.0001915242,0.0003430522,0.002789154,0.0006305039,0.001383453,0.000534873,0.0004287731,0.005616552],"category_scores_gemma":[0.02362403,0.0001997036,0.0004055581,0.002287036,0.002355508,0.00278623,0.0015342,0.0006632689,0.0003319191],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004886411,"about_ca_system_score_gemma":0.0002938501,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001847284,"about_ca_topic_score_gemma":0.001283263,"domain_scores_codex":[0.9970349,0.001815225,0.0002057581,0.000367607,0.0004651159,0.0001114766],"domain_scores_gemma":[0.967098,0.02701966,0.002010264,0.002601432,0.0009482528,0.0003224616],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008519601,0.0002218624,0.6975921,0.0002992708,0.00031396,0.0006927004,0.0232775,0.003829469,0.02238662,0.1458796,0.001399209,0.1032558],"study_design_scores_gemma":[0.0000803433,0.0002978111,0.7694011,0.00007772271,0.0001635643,0.002400499,0.009844065,0.04389394,0.005464001,0.1612812,0.006967239,0.0001285441],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9689913,0.0001086822,0.02123213,0.0001699095,0.00001832917,0.00002793834,0.0002313674,0.00005802461,0.009162258],"genre_scores_gemma":[0.9963719,0.00002696778,0.002979024,0.00001377046,0.00001649127,0.00002207655,0.00009404004,0.00003395575,0.0004416808],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005616552,"threshold_uncertainty_score":0.01878923,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03382856162492674,"score_gpt":0.2577247671016593,"score_spread":0.2238962054767325,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}