{"id":"W4416011069","doi":"10.1287/mnsc.2023.03523","title":"Model Aggregation for Risk Evaluation and Robust Optimization","year":2025,"lang":"en","type":"article","venue":"Management Science","topic":"Risk and Portfolio Optimization","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Expected shortfall; Axiom; Equivalence (formal languages); Axiomatic system; Robust optimization; Value at risk; Risk management; Portfolio; Risk measure","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00732816,0.002480883,0.002037164,0.002440501,0.001060949,0.004817437,0.00220791,0.001918343,0.005961464],"category_scores_gemma":[0.0131554,0.0008921786,0.003379289,0.002883072,0.002568997,0.006204714,0.005412434,0.005453137,0.001156411],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003644387,"about_ca_system_score_gemma":0.002592697,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002558822,"about_ca_topic_score_gemma":0.002064981,"domain_scores_codex":[0.9911165,0.004173512,0.0004711971,0.001234376,0.002583844,0.0004205615],"domain_scores_gemma":[0.9948454,0.002596234,0.000529575,0.000997444,0.000839618,0.0001916927],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00001149427,0.0000252565,0.0001983524,0.0001024357,0.00006703444,0.00006311353,0.00008636146,0.06526599,0.0005194319,0.9080727,0.002640689,0.02294727],"study_design_scores_gemma":[0.000006542493,0.0000268713,0.00009680512,0.00005597055,0.00002699135,0.00005524118,0.00002519481,0.2663534,0.0004577971,0.7248034,0.008068084,0.00002358803],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.001041806,0.0005331181,0.9907119,0.0005624525,0.00008351632,0.00002759434,0.00008512285,0.00009529308,0.006859247],"genre_scores_gemma":[0.2648006,0.002629111,0.7177886,0.000827486,0.0009088697,0.0005894384,0.0006062114,0.0004993918,0.01135021],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.00732816,"threshold_uncertainty_score":0.03875554,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09926344080492287,"score_gpt":0.3983580275553127,"score_spread":0.2990945867503899,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}