{"id":"W4322099996","doi":"10.48550/arxiv.2302.11835","title":"Reinforcement Learning for Combining Search Methods in the Calibration of Economic ABMs","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Complex Systems and Time Series Analysis","field":"Economics, Econometrics and Finance","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Universität Bielefeld; Banca d'Italia; European Commission; Institute for Catastrophic Loss Reduction","keywords":"Reinforcement learning; Benchmark (surveying); Computer science; Calibration; Scheme (mathematics); Artificial intelligence; Machine learning; Random search; Algorithm; Mathematics; Statistics","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009027396,0.001483071,0.001751655,0.001503401,0.0006122942,0.001368788,0.002083573,0.002183239,0.00160936],"category_scores_gemma":[0.03443297,0.0007572356,0.0007328989,0.0007101768,0.001827256,0.001956665,0.00206107,0.002097702,0.0003827817],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00110503,"about_ca_system_score_gemma":0.001617373,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003659914,"about_ca_topic_score_gemma":0.003230405,"domain_scores_codex":[0.9976053,0.00152395,0.0001249064,0.0003189257,0.0002942208,0.0001326273],"domain_scores_gemma":[0.9871868,0.009791512,0.001207068,0.000660135,0.000783288,0.0003711432],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00009331996,0.00006973209,0.001591361,0.00007378014,0.00008758801,0.00003339159,0.00004768477,0.9685759,0.0004762289,0.006308611,0.0003169568,0.02232536],"study_design_scores_gemma":[0.00003083075,0.0000367526,0.0001042335,0.00001716257,0.00001048181,0.000008764769,0.00000603259,0.9961084,0.0002047014,0.003289519,0.000175552,0.000007504487],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07453348,0.001036785,0.9202319,0.0006193071,0.00008171655,0.0001974696,0.00006646207,0.0007087861,0.002523947],"genre_scores_gemma":[0.8010855,0.0002571045,0.1968988,0.0002920566,0.0000711677,0.0003493622,0.0001060782,0.0001120822,0.0008278303],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009027396,"threshold_uncertainty_score":0.04774201,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2280180507669305,"score_gpt":0.2612564426857824,"score_spread":0.03323839191885189,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}