{"id":"W2135032142","doi":"10.5539/ijel.v2n6p27","title":"Transitional Probability and Word Segmentation","year":2012,"lang":"en","type":"article","venue":"International Journal of English Linguistics","topic":"Language Development and Disorders","field":"Psychology","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Word (group theory); Segmentation; Text segmentation; Computer science; Artificial intelligence; Computation; Natural language processing; Statistical learning; Probability distribution; Linguistics; Mathematics; Statistics; Algorithm","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003660318,0.00006878997,0.00008662482,0.000092742,0.00002269294,0.00002772524,0.0001081902,0.00004543533,0.0006728584],"category_scores_gemma":[0.006988086,0.00006168199,0.0000428871,0.00003984568,0.00004245466,0.00007792532,0.00001452896,0.0001232256,0.000007456896],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00004395869,"about_ca_system_score_gemma":0.00003231903,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000004225547,"about_ca_topic_score_gemma":0.000001951968,"domain_scores_codex":[0.9992117,0.00003826039,0.0002978779,0.00006175133,0.0002736734,0.0001166849],"domain_scores_gemma":[0.995575,0.0001130683,0.0001602563,0.00004190959,0.004028891,0.00008083632],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001266998,0.002030257,0.570974,0.00004281774,0.001374757,0.0001017922,0.09296628,0.00006979945,0.00009458022,0.2285507,0.05376744,0.04876053],"study_design_scores_gemma":[0.005039902,0.0001430364,0.3434664,0.00007199739,0.0001591913,0.00004596889,0.009322933,0.00001309328,0.0004063761,0.01392213,0.6269335,0.0004754812],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7982991,0.001470141,0.002960062,0.0001294274,0.06023894,0.0001561416,0.00004052981,0.00003538674,0.1366703],"genre_scores_gemma":[0.9851943,0.00001639587,0.006352144,0.000203105,0.008093056,0.000002066885,0.00001846414,0.000007251739,0.0001131646],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5731661,"threshold_uncertainty_score":0.8365897,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02026763445237813,"score_gpt":0.3153563173588409,"score_spread":0.2950886829064628,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}