{"id":"W2074118501","doi":"10.3115/1641976.1641987","title":"A measure of aggregate syntactic distance","year":2006,"lang":"en","type":"article","venue":"","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":28,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Oulun Yliopisto; Rijksuniversiteit Groningen; Université de Moncton","keywords":"Trigram; Syntax; Computer science; Natural language processing; Measure (data warehouse); Aggregate (composite); Artificial intelligence; Permutation (music); Syntactic structure","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00252367,0.0006158829,0.0009151332,0.00767521,0.0006786427,0.002446197,0.001030575,0.000999694,0.003222042],"category_scores_gemma":[0.01705276,0.0002168008,0.0005738493,0.006942266,0.00122559,0.004043109,0.001977442,0.0009748506,0.001458242],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005199054,"about_ca_system_score_gemma":0.0004176871,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005881459,"about_ca_topic_score_gemma":0.0005951112,"domain_scores_codex":[0.9954521,0.0007681708,0.0005836129,0.0009028603,0.002054597,0.0002386836],"domain_scores_gemma":[0.9875244,0.005997411,0.001543866,0.002189225,0.002286842,0.0004582083],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001484896,0.0005584698,0.1918432,0.000868179,0.00119052,0.0006661398,0.002804227,0.01842674,0.08863933,0.07286567,0.007092324,0.6135601],"study_design_scores_gemma":[0.0001409315,0.002990921,0.455645,0.0001716093,0.0006381534,0.005295346,0.004339234,0.2073353,0.05520808,0.2328378,0.03481787,0.0005798178],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.628944,0.0008157823,0.3462701,0.0003245574,0.000182344,0.0002267354,0.00438568,0.001651042,0.01719995],"genre_scores_gemma":[0.9044977,0.0002124857,0.08841786,0.00008975391,0.0001191007,0.0002627767,0.00394954,0.0002622289,0.002188601],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.00767521,"threshold_uncertainty_score":0.01334661,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.007379287816726015,"score_gpt":0.2348163491163288,"score_spread":0.2274370612996028,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}