{"id":"W4388092895","doi":"10.48550/arxiv.2310.18811","title":"Hierarchical Framework for Interpretable and Probabilistic Model-Based Safe Reinforcement Learning","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Software Reliability and Analysis Research","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Science Foundation Ireland; European Commission; Canadian Institute of Steel Construction","keywords":"Reinforcement learning; Interpretability; Probabilistic logic; Computer science; Artificial intelligence; Machine learning; Black box; Domain (mathematical analysis); Focus (optics)","routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001577796,0.001016349,0.001074642,0.0006870519,0.0004135189,0.001130388,0.002257066,0.00120511,0.004820513],"category_scores_gemma":[0.003783595,0.0006985721,0.001061331,0.0005007979,0.001466018,0.001349483,0.002267719,0.002766967,0.0008260589],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001694582,"about_ca_system_score_gemma":0.002238601,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008564402,"about_ca_topic_score_gemma":0.009280719,"domain_scores_codex":[0.9991063,0.0003023618,0.00005523263,0.0002047899,0.0002156802,0.0001154841],"domain_scores_gemma":[0.998521,0.000808923,0.0001649949,0.0001682195,0.000222973,0.0001139118],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004502078,0.00003744869,0.0002945565,0.00007167763,0.00003756261,0.00007837131,0.0001045545,0.904131,0.001320308,0.06707313,0.0009623408,0.02584398],"study_design_scores_gemma":[0.000006107687,0.00001502691,0.00002904822,0.000005118961,0.000004035537,0.000005580807,0.000003385451,0.9822504,0.000150777,0.01710778,0.0004189989,0.00000367975],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.002734332,0.0001277755,0.9951659,0.0001281391,0.00001783373,0.00001958839,0.00004656124,0.0003919827,0.001367987],"genre_scores_gemma":[0.6634912,0.0003996705,0.3290968,0.0002667241,0.0001025159,0.0003673521,0.0003385142,0.0002757516,0.005661432],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008564402,"threshold_uncertainty_score":0.01702911,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.09495309765304245,"score_gpt":0.2452769170882211,"score_spread":0.1503238194351786,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}