{"id":"W4400586091","doi":"10.20944/preprints202407.0917.v1","title":"AVaTER: A Multimodal Approach of Recognizing Emotion using Cross-modal Attention Technique","year":2024,"lang":"en","type":"preprint","venue":"Preprints.org","topic":"Emotion and Mood Recognition","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Athabasca University","funders":"","keywords":"Bengali; Sadness; Computer science; Modalities; Anger; Emotion recognition; Artificial intelligence; Robustness (evolution); Speech recognition; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.001602818,0.0005144718,0.0006256397,0.0006496473,0.0001163259,0.00005591335,0.0004359355,0.001241244,0.001950031],"category_scores_gemma":[0.00009231028,0.0005641761,0.0005621699,0.0002890162,0.0001957686,0.000116524,0.001516781,0.001791365,0.001507212],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002489502,"about_ca_system_score_gemma":0.0001236008,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007127058,"about_ca_topic_score_gemma":0.000005265385,"domain_scores_codex":[0.995926,0.0004751891,0.001133539,0.001610537,0.000385071,0.0004697281],"domain_scores_gemma":[0.9976443,0.0000428269,0.0007006924,0.001101417,0.0003816908,0.000129057],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0005274884,0.002696518,0.5180659,0.00580004,0.001818597,0.00006507707,0.005881042,0.001477849,0.4458656,0.001949691,0.00008250918,0.0157697],"study_design_scores_gemma":[0.002027637,0.0001103988,0.81991,0.003542075,0.0009908174,0.0003878038,0.001019068,0.01006189,0.1375945,0.0221823,0.0003144018,0.001859141],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9354232,0.0001075239,0.0123247,0.00004794416,0.003244747,0.001852875,0.0001026429,0.0004966929,0.04639968],"genre_scores_gemma":[0.9904131,0.00002897289,0.005337776,0.00003226959,0.0004414696,0.0004728741,0.0004084606,0.0001274567,0.002737647],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3082711,"threshold_uncertainty_score":0.999681,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2155321831759116,"score_gpt":0.4270973413613872,"score_spread":0.2115651581854756,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}