{"id":"W4416157662","doi":"10.48550/arxiv.2511.06497","title":"Rethinking what Matters: Effective and Robust Multilingual Realignment for Low-Resource Languages","year":2025,"lang":"","type":"preprint","venue":"ArXiv.org","topic":"ICT in Developing Communities","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada; Grand Équipement National De Calcul Intensif; Compute Canada","keywords":"Word (group theory); Transfer (computing); Empirical research; Multilingualism; Language model; Word identification; Data collection","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","scholarly_communication","open_science"],"consensus_categories":[],"category_scores_codex":[0.002370016,0.001077661,0.001153363,0.0005085692,0.001166456,0.001883889,0.003300627,0.0007322067,0.00001446478],"category_scores_gemma":[0.0006429883,0.001172116,0.0003372933,0.0003850722,0.0005380139,0.000944472,0.009392059,0.001735515,0.0000254264],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005788837,"about_ca_system_score_gemma":0.0004138117,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004333192,"about_ca_topic_score_gemma":0.00009502714,"domain_scores_codex":[0.9944392,0.001030509,0.001058636,0.001733623,0.0006291101,0.001108937],"domain_scores_gemma":[0.9913185,0.004578612,0.0007113047,0.0027386,0.000457671,0.0001953368],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004875429,0.0006880371,0.02967462,0.01442023,0.00231519,0.0002360135,0.6472792,0.01930093,0.0007711266,0.004295955,0.003553058,0.2769781],"study_design_scores_gemma":[0.01446587,0.002473158,0.1358908,0.1907783,0.002072896,0.0003645393,0.1237078,0.2184641,0.2137974,0.03196147,0.04977037,0.01625312],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8360839,0.005975202,0.1388618,0.009000092,0.004453321,0.004388109,0.00007202027,0.0005365253,0.0006290111],"genre_scores_gemma":[0.8930534,0.003069203,0.08419304,0.01289405,0.001086758,0.001474234,0.0002009771,0.0001732479,0.003855065],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5235714,"threshold_uncertainty_score":0.9991522,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04868336307078377,"score_gpt":0.3027608409348006,"score_spread":0.2540774778640169,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}