{"id":"W4404782786","doi":"10.18653/v1/2024.emnlp-main.338","title":"CItruS: Chunked Instruction-aware State Eviction for Long Sequence Modeling","year":2024,"lang":"en","type":"article","venue":"","topic":"Neural Networks and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"National Natural Science Foundation of China; McGill University; Canadian Institute for Advanced Research; Nvidia","keywords":"Sequence (biology); Computer science; State (computer science); Eviction; Algorithm; Chemistry; Political science","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000645904,0.0009985009,0.0006142371,0.0004015685,0.0003715917,0.0005969023,0.001727444,0.0007893423,0.00360088],"category_scores_gemma":[0.002710771,0.0004358331,0.0007048515,0.000390241,0.0004364563,0.001774399,0.001013112,0.00178353,0.001274503],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007624933,"about_ca_system_score_gemma":0.001364203,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006607113,"about_ca_topic_score_gemma":0.01621073,"domain_scores_codex":[0.9997028,0.00008227886,0.00001944682,0.0001166265,0.00004839961,0.00003049409],"domain_scores_gemma":[0.9990701,0.0004921094,0.00006170566,0.000243264,0.00009074549,0.00004205076],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005995656,0.0001895658,0.001905655,0.0002768702,0.0001547142,0.000322652,0.0004856451,0.3018058,0.03564022,0.01609648,0.01789991,0.6246229],"study_design_scores_gemma":[0.00001953408,0.00004264609,0.0001335963,0.00000770866,0.00001094069,0.00003538761,0.00002157447,0.9803774,0.00987861,0.007495206,0.001966126,0.00001129894],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02277731,0.0004857086,0.9562474,0.0002085976,0.00008752401,0.00006679637,0.0004276586,0.01874487,0.0009540594],"genre_scores_gemma":[0.3919654,0.0003349356,0.5956993,0.000394115,0.00006995068,0.0002453186,0.002381655,0.002034615,0.006874939],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006607113,"threshold_uncertainty_score":0.01313734,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04809721246414919,"score_gpt":0.3023897600606,"score_spread":0.2542925475964508,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}