{"id":"W4389104731","doi":"10.1109/jsac.2023.3336191","title":"Safe and Accelerated Deep Reinforcement Learning-Based O-RAN Slicing: A Hybrid Transfer Learning Approach","year":2023,"lang":"en","type":"article","venue":"IEEE Journal on Selected Areas in Communications","topic":"Energy Harvesting in Wireless Networks","field":"Engineering","cited_by":30,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary; Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Reinforcement learning; Computer science; Radio access network; Transfer of learning; Software deployment; Ran; Slicing; Reuse; Distributed computing; Artificial intelligence; Machine learning; Computer network; Software engineering; World Wide Web","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.0006136468,0.0002646693,0.0003002569,0.0005674363,0.0006092259,0.0001708288,0.0006125325,0.0001233923,0.00001924323],"category_scores_gemma":[0.000243709,0.000280695,0.00005986992,0.001632084,0.00008058632,0.0001602705,0.00004168768,0.002625885,0.00001569801],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002137061,"about_ca_system_score_gemma":0.00007106147,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001957128,"about_ca_topic_score_gemma":0.00006528914,"domain_scores_codex":[0.9980286,0.0004420556,0.0005770018,0.0001925672,0.0002774578,0.000482325],"domain_scores_gemma":[0.9983031,0.0007522051,0.00007757531,0.0005179119,0.0001790213,0.0001702152],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002225996,0.00004811049,0.001471399,0.00002293904,0.00006046707,0.00001011428,0.0004609308,0.993729,0.001252555,0.00009679488,0.0002012381,0.002624193],"study_design_scores_gemma":[0.0008736592,0.0001017442,0.003117934,0.000251987,0.00002321915,0.00006020379,0.00009588813,0.991549,0.0007347742,0.00002141984,0.002883278,0.0002868814],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8779768,0.0006336158,0.1092054,0.00047528,0.0002521445,0.0003685262,0.00000165082,0.001530302,0.009556252],"genre_scores_gemma":[0.9962272,0.001843747,0.001352965,0.00006484636,0.00008198629,0.00006506771,0.0001220645,0.00008877133,0.0001533507],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1182504,"threshold_uncertainty_score":0.9999645,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03479004449132257,"score_gpt":0.2582315237344848,"score_spread":0.2234414792431622,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}