{"id":"W4402916681","doi":"10.1109/cvprw63382.2024.00483","title":"Recursive Joint Cross-Modal Attention for Multimodal Fusion in Dimensional Emotion Recognition","year":2024,"lang":"en","type":"article","venue":"","topic":"Emotion and Mood Recognition","field":"Psychology","cited_by":37,"is_retracted":false,"has_abstract":true,"ca_institutions":"Computer Research Institute of Montréal","funders":"Government of Canada","keywords":"Modal; Joint (building); Computer science; Joint attention; Emotion recognition; Fusion; Artificial intelligence; Sensor fusion; Speech recognition; Psychology; Engineering; Linguistics; Developmental psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001385993,0.00120712,0.000848671,0.0008512435,0.0003363623,0.0007677389,0.001161919,0.0007464912,0.002699542],"category_scores_gemma":[0.002505249,0.0002904481,0.001436624,0.0007045201,0.0004582459,0.001451137,0.001769694,0.001632782,0.0008556825],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007908922,"about_ca_system_score_gemma":0.0004665,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005814987,"about_ca_topic_score_gemma":0.007624659,"domain_scores_codex":[0.999339,0.0001636561,0.00002828558,0.0002240558,0.000121337,0.0001235929],"domain_scores_gemma":[0.9994771,0.0002117903,0.00004357784,0.0000811926,0.0001517288,0.00003471602],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006041673,0.0003585439,0.00478173,0.0001849777,0.000414081,0.0002302212,0.0004101437,0.1633175,0.0574979,0.006714256,0.007571959,0.7579145],"study_design_scores_gemma":[0.000009322576,0.00008881606,0.002483273,0.00001792364,0.00007317329,0.00009203414,0.00005054586,0.9811936,0.007694322,0.006904833,0.001368361,0.00002388314],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.08277635,0.002816458,0.9063831,0.0004665359,0.0001920775,0.00009046109,0.0003078645,0.002758894,0.004208356],"genre_scores_gemma":[0.9063301,0.0006622222,0.08679853,0.0005378061,0.0001346698,0.0001274979,0.0008815793,0.0001588036,0.004368858],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005814987,"threshold_uncertainty_score":0.01156229,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05696451732873455,"score_gpt":0.3580482698929103,"score_spread":0.3010837525641758,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}