{"id":"W4415524602","doi":"10.1109/mlsp62443.2025.11204312","title":"Tackling Distribution Shift in LLM via KILO: Knowledge-Instructed Learning for Continual Adaptation","year":2025,"lang":"","type":"article","venue":"","topic":"Domain Adaptation and Few-Shot Learning","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"","keywords":"Adaptability; Adaptation (eye); Domain (mathematical analysis); Domain knowledge; Domain adaptation; Language model; Deep learning; Production (economics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.001665891,0.0004651172,0.0005787232,0.0005357304,0.0007738245,0.0007446797,0.0006951935,0.0003507975,0.0001231172],"category_scores_gemma":[0.001292729,0.0005369956,0.0002356126,0.002357067,0.0001401093,0.001103789,0.0003008148,0.0008249325,0.00009841374],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005108023,"about_ca_system_score_gemma":0.0006349544,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002076104,"about_ca_topic_score_gemma":0.0006072802,"domain_scores_codex":[0.995739,0.0005751179,0.001290738,0.001121439,0.000357465,0.0009161919],"domain_scores_gemma":[0.9974627,0.0009472288,0.0004412907,0.0004002463,0.0005668267,0.000181739],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002087872,0.0003247212,0.001860252,0.0001854124,0.00006697483,0.000005832903,0.01060084,0.03659971,0.0004066806,0.1552896,0.0003970229,0.7940542],"study_design_scores_gemma":[0.003172882,0.0002567049,0.01746706,0.0003702668,0.00003719392,0.000002811293,0.00193142,0.9340998,0.0004090062,0.003742488,0.03800243,0.0005079699],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01633701,0.0005136243,0.9710953,0.0009016638,0.00220977,0.001013516,0.000009956734,0.0003062659,0.007612919],"genre_scores_gemma":[0.9730957,0.00003047922,0.02124891,0.0001789466,0.0001418265,0.00008896839,0.0002402809,0.00002587821,0.004949084],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9567586,"threshold_uncertainty_score":0.9997082,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01583959248627164,"score_gpt":0.2838098955907525,"score_spread":0.2679703031044809,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}