{"id":"W4402916600","doi":"10.1109/cvprw63382.2024.00465","title":"Joint Multimodal Transformer for Emotion Recognition in the Wild","year":2024,"lang":"en","type":"article","venue":"","topic":"IoT-based Smart Home Systems","field":"Engineering","cited_by":22,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University; École de Technologie Supérieure","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds de recherche du Québec; Canada Foundation for Innovation","keywords":"Transformer; Computer science; Joint (building); Emotion recognition; Speech recognition; Artificial intelligence; Engineering; Electrical engineering; Structural engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001006406,0.001322281,0.0007522,0.0007143401,0.0003017612,0.0009277124,0.001284636,0.000764079,0.009080278],"category_scores_gemma":[0.002286274,0.000279453,0.001118038,0.000541813,0.0004390403,0.002456621,0.002476271,0.001340742,0.004895507],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004301741,"about_ca_system_score_gemma":0.0003298777,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001505149,"about_ca_topic_score_gemma":0.002805715,"domain_scores_codex":[0.9993995,0.0001372495,0.00002747583,0.0002283746,0.000120003,0.00008738157],"domain_scores_gemma":[0.9996359,0.0001011894,0.00002576273,0.000109758,0.0001033758,0.00002408922],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000540605,0.0002511653,0.001462781,0.000231263,0.0002087188,0.0001998959,0.0001660356,0.03218718,0.0764717,0.00620207,0.0242395,0.8578392],"study_design_scores_gemma":[0.00002750189,0.0002075308,0.001981776,0.00004174166,0.00008542644,0.000303458,0.0001421665,0.9266555,0.04051375,0.01897754,0.01101186,0.00005186201],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01880801,0.001163963,0.9649039,0.0003468511,0.0003156691,0.0001345339,0.001013519,0.008976111,0.004337464],"genre_scores_gemma":[0.5587822,0.001188404,0.4153244,0.001023832,0.000262811,0.0004100321,0.006348604,0.0009696092,0.01569012],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009080278,"threshold_uncertainty_score":0.03037661,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02443965763466127,"score_gpt":0.2261709150304419,"score_spread":0.2017312573957806,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}