{"id":"W3123503485","doi":"10.2139/ssrn.3514586","title":"Deep Hedging of Derivatives Using Reinforcement Learning","year":2019,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Stochastic processes and financial applications","field":"Economics, Econometrics and Finance","cited_by":14,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Reinforcement; Reinforcement learning; Artificial intelligence; Computer science; Psychology; Social psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001029551,0.0004360072,0.000908472,0.0003255606,0.0002352621,0.0009754095,0.00073482,0.001030053,0.002617781],"category_scores_gemma":[0.003528487,0.00043728,0.0003685306,0.0002869353,0.0005690012,0.001032926,0.000771003,0.001371642,0.0001974505],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006571652,"about_ca_system_score_gemma":0.0007473283,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0044159,"about_ca_topic_score_gemma":0.004757315,"domain_scores_codex":[0.9998109,0.0000634121,0.0000119603,0.0000366452,0.00004393689,0.00003314908],"domain_scores_gemma":[0.9984,0.00116528,0.0001121224,0.00008855325,0.0001511047,0.00008287578],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008053183,0.00006715666,0.000930702,0.00002730309,0.0000306118,0.00005741683,0.00002254763,0.9606255,0.001046431,0.007724406,0.0004944144,0.02889296],"study_design_scores_gemma":[0.000003196603,0.000007914688,0.00004544939,0.000001797416,0.000001891344,0.000002609002,8.316799e-7,0.9978886,0.00008783722,0.001927056,0.00003150379,0.000001249818],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.2438677,0.001009705,0.7486512,0.0007530085,0.0001338326,0.00005148594,0.00009175062,0.0005491818,0.004892146],"genre_scores_gemma":[0.9821292,0.0001169615,0.0157964,0.00005307585,0.00002205648,0.00001774634,0.00004396451,0.00001898342,0.001801771],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0044159,"threshold_uncertainty_score":0.00878042,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01518483810390456,"score_gpt":0.2252696031373393,"score_spread":0.2100847650334348,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}