{"id":"W2037035662","doi":"10.1080/07350015.2012.663245","title":"Testing Predictive Ability and Power Robustification","year":2012,"lang":"en","type":"article","venue":"Journal of Business and Economic Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":5,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Robustification; Predictive power; Econometrics; Power (physics); Economics; Computer science; Statistics; Mathematics; Physics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007962149,0.00009282486,0.0003067985,0.00009978943,0.00008743184,0.00005289046,0.00005207981,0.00005770675,0.0000399089],"category_scores_gemma":[0.0005909891,0.00009892097,0.00001952774,0.00005746006,0.00006906429,0.0004628254,0.00002884768,0.0001071673,0.000009227289],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00007677144,"about_ca_system_score_gemma":0.00003231747,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001361094,"about_ca_topic_score_gemma":0.000004986617,"domain_scores_codex":[0.9990183,0.000008387184,0.0006673869,0.0001243423,0.00001817988,0.0001634364],"domain_scores_gemma":[0.9989391,0.0001711404,0.0005926465,0.00008916032,0.0001118922,0.00009607754],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00004399433,0.00005666207,0.9396386,0.00005547199,0.00002773239,8.073831e-7,0.0006555115,0.001043654,0.00002034516,0.05013422,0.0002987332,0.008024231],"study_design_scores_gemma":[0.000266362,0.00004546357,0.9470279,0.00001779093,0.00001289482,0.00002520794,0.00007184446,0.03036747,0.000002945328,0.02093101,0.001122775,0.0001083277],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7814977,0.002011063,0.2150869,0.00008549275,0.0005401726,0.0000540285,0.0001918361,0.000004057917,0.0005287316],"genre_scores_gemma":[0.9774934,0.0002946123,0.02196177,0.00002225146,0.0002019059,0.000001167414,0.000002674734,0.0000100236,0.00001216979],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1959957,"threshold_uncertainty_score":0.403388,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04819134740959687,"score_gpt":0.2348782080515698,"score_spread":0.1866868606419729,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}