{"id":"W4416922377","doi":"10.1109/iscipt67144.2025.11265207","title":"Enhancing Speech Emotion Recognition through Domain-Aware Data Augmentation and Model Explainability","year":2025,"lang":"","type":"article","venue":"","topic":"Emotion and Mood Recognition","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Discriminative model; Naturalness; Feature (linguistics); Mel-frequency cepstrum; Interpretability; Cepstrum; Random forest; Speech processing; Frequency domain; Set (abstract data type)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001550481,0.0004808082,0.0004799454,0.0003057398,0.0006103403,0.0002046293,0.0003354171,0.0006221141,0.00281792],"category_scores_gemma":[0.0001959069,0.0005326879,0.0001060846,0.0005787633,0.0002372584,0.00135,0.0004116182,0.0005139139,0.0003347156],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002745003,"about_ca_system_score_gemma":0.0002219862,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000370874,"about_ca_topic_score_gemma":0.0008059131,"domain_scores_codex":[0.9953929,0.0007637946,0.001162601,0.001771371,0.0003306312,0.0005787387],"domain_scores_gemma":[0.9975891,0.0002500323,0.0003440405,0.001306101,0.0003743745,0.0001363826],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001434819,0.003330399,0.001091668,0.002677242,0.0007577026,0.00002896318,0.01756676,0.00007061689,0.007567789,0.01417579,0.03375673,0.9175415],"study_design_scores_gemma":[0.01765479,0.0008743982,0.007081027,0.002664204,0.001689857,0.0001770593,0.09507073,0.1575662,0.02964991,0.678636,0.006356961,0.00257884],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2503975,0.0003994728,0.6540474,0.00370419,0.002506476,0.001827745,0.0004562951,0.0003277856,0.08633312],"genre_scores_gemma":[0.9437539,0.001494618,0.03868012,0.002831997,0.000287474,0.0000920912,0.004927315,0.00005252829,0.007879973],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9149627,"threshold_uncertainty_score":0.9997125,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09201412078655065,"score_gpt":0.3795046234331793,"score_spread":0.2874905026466286,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}