{"id":"W4409348132","doi":"10.1609/aaai.v39i23.34639","title":"Prompt Compression with Context-Aware Sentence Encoding for Fast and Improved LLM Inference","year":2025,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Natural Language Processing Techniques","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University","funders":"","keywords":"Encoding (memory); Sentence; Inference; Computer science; Context (archaeology); Compression (physics); Natural language processing; Artificial intelligence; Speech recognition; History","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003951492,0.0003077174,0.0003551678,0.0001889318,0.0003650851,0.0004508225,0.001932394,0.0001249632,0.000004840582],"category_scores_gemma":[0.0005036905,0.0002023078,0.00007033067,0.000671095,0.0004178154,0.0006523088,0.0006545863,0.0003659949,0.000001738575],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005053903,"about_ca_system_score_gemma":0.0001798141,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00005020958,"about_ca_topic_score_gemma":0.00002265762,"domain_scores_codex":[0.9980906,0.00001676491,0.0004832706,0.0007056888,0.0003174856,0.0003862262],"domain_scores_gemma":[0.997779,0.0002423014,0.000426844,0.000332964,0.001140174,0.00007877976],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0001191409,0.00009948978,0.0003732772,0.000230411,0.00001720527,3.335662e-7,0.0008343637,0.000003944374,0.110262,0.715955,0.00006295841,0.1720419],"study_design_scores_gemma":[0.00007183164,0.0003308441,0.00006341813,0.001618305,0.00001769275,0.000004794515,0.0006123299,0.09611549,0.7377278,0.1631369,0.00004655229,0.0002539777],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03423095,0.0002512793,0.9553169,0.005910907,0.0003058306,0.001792346,0.00001287502,0.0004295545,0.001749348],"genre_scores_gemma":[0.9553515,0.00002768717,0.04388431,0.0003481144,0.0000224457,0.000123719,6.661904e-7,0.00001142191,0.0002301753],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9211205,"threshold_uncertainty_score":0.8249872,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03933237982885971,"score_gpt":0.3119017386325069,"score_spread":0.2725693588036472,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}