{"id":"W3181040298","doi":"10.1287/opre.2021.0393","title":"Technical Note—A Data-Driven Approach to Beating SAA Out of Sample","year":2023,"lang":"en","type":"article","venue":"Operations Research","topic":"Risk and Portfolio Optimization","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Robust optimization; Sample (material); Computer science; Mistake; Optimization problem; Mathematical optimization; Set (abstract data type); Task (project management); Data set; Artificial intelligence; Mathematics; Algorithm; Economics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00807095,0.00007548906,0.0001907141,0.0008921075,0.0005309531,0.0003957536,0.001623798,0.00008253035,0.0001735025],"category_scores_gemma":[0.01780735,0.00005807632,0.00003647561,0.004329776,0.0001266195,0.0004300271,0.001061425,0.0002484459,0.001206156],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00003499544,"about_ca_system_score_gemma":0.0002878285,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004134163,"about_ca_topic_score_gemma":0.0006660444,"domain_scores_codex":[0.9959319,0.0004135261,0.0005697648,0.0005733255,0.002173707,0.0003377399],"domain_scores_gemma":[0.9955921,0.001616543,0.00002884587,0.001576851,0.001037975,0.0001476583],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00001891784,0.0001527365,0.002418682,0.000003969996,0.000005758109,0.000002035641,0.0020066,0.7818241,0.005535278,0.008400703,0.1293257,0.07030556],"study_design_scores_gemma":[0.0001148261,0.00006282612,0.002104576,0.000007591671,0.000002568906,0.000001163365,0.0008763625,0.9536642,0.0003839133,0.0006464318,0.04204569,0.00008989256],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02887111,0.0000243243,0.9239123,0.003399764,0.000216743,0.001189298,0.0006351154,0.000124558,0.0416268],"genre_scores_gemma":[0.7065201,0.0001185676,0.284594,0.00004835779,0.0001887264,0.0001204937,0.0008322407,0.00002195483,0.007555604],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.677649,"threshold_uncertainty_score":0.9995715,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5361502316087712,"score_gpt":0.5619995598826671,"score_spread":0.02584932827389597,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}