{"id":"W4414897276","doi":"10.1145/3715071.3750540","title":"SAHARA: Self-supervised Approach for Human Activity Recognition based on Audio Events","year":2025,"lang":"en","type":"article","venue":"","topic":"Music and Audio Processing","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Activity recognition; Pattern recognition (psychology); Noise (video); Feature (linguistics); Event (particle physics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000282458,0.0001229204,0.0001391683,0.0001150133,0.0002966987,0.0001010879,0.0003655129,0.00006437032,0.00001933139],"category_scores_gemma":[0.00002195145,0.0001069705,0.00007829841,0.0003041152,0.00001044474,0.0002943255,0.00006491695,0.00008931854,0.000009744414],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005773838,"about_ca_system_score_gemma":0.0001010797,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001031764,"about_ca_topic_score_gemma":0.000001824294,"domain_scores_codex":[0.9990445,0.0000471725,0.0001247256,0.0004178188,0.0001564225,0.0002094086],"domain_scores_gemma":[0.9994591,0.00007076457,0.000050796,0.0003056458,0.00007125094,0.00004241489],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00005984188,0.001453991,0.0005460703,0.0005787433,0.00005919074,0.000001426256,0.0002374537,0.0002395675,0.007295275,0.008095558,0.01223549,0.9691974],"study_design_scores_gemma":[0.001512529,0.0001156328,0.002035622,0.0000903928,0.00001930686,4.863765e-7,0.000008724913,0.9571706,0.03042553,0.007275742,0.001078663,0.0002667544],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01671795,0.000004380921,0.9390814,0.0008888539,0.0001305727,0.0003282269,0.000002121644,0.0002840163,0.04256244],"genre_scores_gemma":[0.7932963,4.989535e-7,0.2027649,0.002875847,0.00004642413,0.0000889681,0.00001229782,0.000005631227,0.0009091616],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9689307,"threshold_uncertainty_score":0.436213,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03742720112442307,"score_gpt":0.280006227235659,"score_spread":0.2425790261112359,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}