{"id":"W7046899305","doi":"","title":"Enhancing Automatic Speech Recognition of a Regional Dialect: A Pilot Study with Québécois French","year":2023,"lang":"en","type":"article","venue":"Canadian acoustics","topic":"Superconducting and THz Device Technology","field":"Physics and Astronomy","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Pipeline (software); Word error rate; Context (archaeology); Encoder; Training set; Language model; Set (abstract data type); Transcription (linguistics)","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":true,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001930224,0.0009432404,0.0006082359,0.0005290656,0.0009838331,0.0008701046,0.0007712532,0.000783347,0.003644679],"category_scores_gemma":[0.003763436,0.0001613511,0.0004333276,0.000437444,0.0006895436,0.000600498,0.0005783602,0.0006389524,0.001212258],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00206961,"about_ca_system_score_gemma":0.002304644,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.3411338,"about_ca_topic_score_gemma":0.4097592,"domain_scores_codex":[0.9985877,0.0005135807,0.00005334675,0.0003669077,0.0002760283,0.0002023837],"domain_scores_gemma":[0.9966797,0.00112866,0.00006669766,0.0002507129,0.001650006,0.0002244166],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.004091087,0.002734316,0.0462006,0.002127839,0.0006544315,0.005149906,0.01383119,0.03753942,0.4229849,0.001630741,0.03589512,0.4271604],"study_design_scores_gemma":[0.001608677,0.01161873,0.4111736,0.0003289678,0.0008269327,0.004359366,0.017964,0.1951292,0.237682,0.001070408,0.1176113,0.0006268257],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9822215,0.0003650342,0.008930405,0.000346904,0.0000912602,0.0003270323,0.002074274,0.001278799,0.004364774],"genre_scores_gemma":[0.9702195,0.0002116696,0.01433029,0.0003662146,0.00005842575,0.0002891798,0.00610504,0.0002604258,0.008159243],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6588662,"threshold_uncertainty_score":0.6782963,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03014472926392299,"score_gpt":0.2397896095011883,"score_spread":0.2096448802372653,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}