{"id":"W2944426940","doi":"10.1109/taslp.2019.2912123","title":"Non-Intrusive Speech Quality Prediction Using Modulation Energies and LSTM-Network","year":2019,"lang":"en","type":"article","venue":"IEEE/ACM Transactions on Audio Speech and Language Processing","topic":"Speech and Audio Processing","field":"Computer Science","cited_by":44,"is_retracted":false,"has_abstract":true,"ca_institutions":"Institut National de la Recherche Scientifique; Université du Québec à Montréal","funders":"Bundesministerium für Bildung und Forschung; Deutsche Forschungsgemeinschaft","keywords":"Computer science; Speech recognition; Benchmark (surveying); Measure (data warehouse); Reverberation; Quality (philosophy); Speech processing; Noise (video); Range (aeronautics); Artificial neural network; SIGNAL (programming language); PESQ; Speech enhancement; Sound quality; Energy (signal processing); Artificial intelligence; Data mining; Noise reduction; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001109774,0.001521072,0.0006433293,0.001289307,0.0001787254,0.000693129,0.0008137395,0.0007992637,0.0008155797],"category_scores_gemma":[0.003868652,0.0003240226,0.0004915454,0.0006786547,0.0003239577,0.001354678,0.0006889603,0.0009516937,0.0004173245],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005564139,"about_ca_system_score_gemma":0.0003175318,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003128799,"about_ca_topic_score_gemma":0.006120152,"domain_scores_codex":[0.9992703,0.0001317276,0.00007325709,0.0001907658,0.0002706004,0.00006330744],"domain_scores_gemma":[0.9986738,0.0005179796,0.0002282919,0.0001134316,0.0004189039,0.00004754177],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008988166,0.000588167,0.01394722,0.0003885048,0.0004505382,0.0003393599,0.0001623895,0.2217477,0.06473899,0.0008355291,0.002527072,0.6933756],"study_design_scores_gemma":[0.00001252148,0.0002124481,0.007027801,0.0000197777,0.00007130182,0.00009186751,0.00002253972,0.9776758,0.01398826,0.0004533992,0.0004002682,0.00002404843],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4305398,0.004377104,0.5570235,0.0003488855,0.0003264306,0.0001918575,0.00070766,0.003018546,0.00346627],"genre_scores_gemma":[0.9165851,0.0007301943,0.07969466,0.0001077402,0.00009160196,0.00008766106,0.0008980203,0.00009287063,0.001712166],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003128799,"threshold_uncertainty_score":0.006221175,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0147511386327966,"score_gpt":0.272053899695278,"score_spread":0.2573027610624814,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}