{"id":"W4416246529","doi":"10.48550/arxiv.2510.19203","title":"Aligning Multilingual News for Stock Return Prediction","year":2025,"lang":"","type":"preprint","venue":"ArXiv.org","topic":"Stock Market Forecasting Methods","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"University of Toronto; Royal Bank of Canada","keywords":"Stock exchange; Stock (firearms); Sharpe ratio; Semantics (computer science); Trading strategy","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","sts","research_integrity"],"consensus_categories":["metaepi_narrow","research_integrity"],"category_scores_codex":[0.02039377,0.001548132,0.002354399,0.001558341,0.001577092,0.0007823723,0.003650546,0.001988524,0.0006573659],"category_scores_gemma":[0.09170402,0.001488541,0.001765167,0.002139643,0.0005232781,0.000580636,0.003954605,0.002500387,0.0001843442],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006519656,"about_ca_system_score_gemma":0.002159946,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004394717,"about_ca_topic_score_gemma":0.0001891565,"domain_scores_codex":[0.9830524,0.0026849,0.004760935,0.005005775,0.002678915,0.001817037],"domain_scores_gemma":[0.9672074,0.02228588,0.003021345,0.00409388,0.002750569,0.000640932],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000897894,0.0001902242,0.5470262,0.0002921135,0.0003340776,0.00001305773,0.002897512,0.00174768,0.001154009,0.00004019636,0.00950544,0.4359016],"study_design_scores_gemma":[0.006897015,0.001525876,0.3769494,0.005440631,0.001818792,0.0000832808,0.005585019,0.3053092,0.02251278,0.01991535,0.2499169,0.004045808],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6935596,0.0007343696,0.2623882,0.0008353235,0.02548742,0.004650434,0.0007427431,0.0004362235,0.0111657],"genre_scores_gemma":[0.7270929,0.0002656034,0.1992452,0.0009204767,0.004756761,0.001376242,0.0001913435,0.000217413,0.06593411],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4318558,"threshold_uncertainty_score":0.9998009,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2345024121321414,"score_gpt":0.4439886005378369,"score_spread":0.2094861884056955,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}