{"id":"W4416595598","doi":"10.2139/ssrn.5800803","title":"Toward Zero-Shot Generalization of Deep Reinforcement Learning for Hybrid Energy System Dispatch","year":2025,"lang":"","type":"preprint","venue":"SSRN Electronic Journal","topic":"Electric Power System Optimization","field":"Engineering","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"McGill University","funders":"","keywords":"Reinforcement learning; Generalization; Generalization error; Normalization (sociology); Generalizability theory; Regularization (linguistics)","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001838082,0.001108123,0.001764485,0.0005312896,0.0004262152,0.0009592372,0.001533685,0.001535838,0.003237308],"category_scores_gemma":[0.005851886,0.0007921276,0.0005973632,0.0003882654,0.001097303,0.001451838,0.001973011,0.002331352,0.0004420874],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0012738,"about_ca_system_score_gemma":0.00137929,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008281782,"about_ca_topic_score_gemma":0.008289462,"domain_scores_codex":[0.9996545,0.0001464798,0.00001670882,0.00007495881,0.00005365829,0.00005375227],"domain_scores_gemma":[0.9975616,0.001783335,0.000122619,0.0001623858,0.0002383587,0.0001317855],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00009435214,0.0000661719,0.0003807394,0.00003667493,0.00003547849,0.00002655681,0.00003386285,0.9653957,0.00046335,0.006116501,0.001235648,0.02611495],"study_design_scores_gemma":[0.000002612554,0.000006164741,0.00001572235,0.000001486763,0.000001037861,0.000001097694,0.00000127846,0.998078,0.00003175921,0.00183864,0.00002139966,8.385298e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.08357595,0.0004268709,0.9100928,0.0005676303,0.00009772727,0.0000607459,0.0001231445,0.0008891876,0.004166044],"genre_scores_gemma":[0.939688,0.0001003677,0.05560021,0.0002445483,0.00006207819,0.00009726395,0.0002062334,0.0001209251,0.00388039],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008281782,"threshold_uncertainty_score":0.01646715,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.009244271775888675,"score_gpt":0.2218974301206986,"score_spread":0.2126531583448099,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}