{"id":"W4404783544","doi":"10.18653/v1/2024.emnlp-main.302","title":"Improving Spoken Language Modeling with Phoneme Classification: A Simple Fine-tuning Approach","year":2024,"lang":"en","type":"article","venue":"","topic":"Speech Recognition and Synthesis","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Agence de l'innovation de Défense; Grand Équipement National De Calcul Intensif; Agence Nationale de la Recherche; École des Hautes Etudes en Sciences Sociales; Canadian Institute for Advanced Research","keywords":"Computer science; Simple (philosophy); Spoken language; Speech recognition; Natural language processing; Language model; Artificial intelligence; Fine-tuning","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005564205,0.001134404,0.0007723766,0.0004330334,0.0003366373,0.001144295,0.001312873,0.0010289,0.006693142],"category_scores_gemma":[0.00247728,0.0003762858,0.0008210349,0.0003820507,0.0003660167,0.001190603,0.0009274026,0.001521008,0.003468852],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004266414,"about_ca_system_score_gemma":0.0006058944,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004669406,"about_ca_topic_score_gemma":0.009727947,"domain_scores_codex":[0.9996125,0.00007830469,0.0000328264,0.0001626305,0.00007396394,0.00003983018],"domain_scores_gemma":[0.9991124,0.000436017,0.00004940552,0.0002152549,0.0001462909,0.00004057412],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003204511,0.0002366341,0.001977932,0.0001499156,0.0002290937,0.0001496466,0.0001089709,0.1773914,0.1203855,0.002336181,0.006253316,0.690461],"study_design_scores_gemma":[0.0000137212,0.0000450666,0.001110687,0.00001036311,0.00003730157,0.00005031859,0.00002392524,0.9718183,0.02131394,0.002988601,0.002565272,0.00002255745],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04282108,0.0008599543,0.9434358,0.0004300782,0.0002139265,0.00008034494,0.0004925955,0.009016357,0.002649812],"genre_scores_gemma":[0.6531719,0.0005348306,0.3301113,0.0007768744,0.0003170483,0.0002324841,0.002141871,0.001004017,0.0117097],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006693142,"threshold_uncertainty_score":0.02239084,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03837804051959954,"score_gpt":0.2513076571257065,"score_spread":0.2129296166061069,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}