{"id":"W4399909891","doi":"10.1109/icnc59896.2024.10556056","title":"Accelerating Autonomous Cyber Operations: A Symbolic Logic Planner Guided Reinforcement Learning Approach","year":2024,"lang":"en","type":"article","venue":"","topic":"AI-based Problem Solving and Planning","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Defence Research and Development Canada; Queen's University","funders":"","keywords":"Planner; Reinforcement learning; Computer science; Logic programming; Artificial intelligence; Human–computer interaction","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004916579,0.0005074447,0.0003391797,0.0003093598,0.0002334018,0.0005349148,0.001055883,0.0005795899,0.002944837],"category_scores_gemma":[0.001713381,0.0002422772,0.0002583998,0.0001656513,0.0009070854,0.0007238946,0.0006826837,0.0008911314,0.0002687431],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007106518,"about_ca_system_score_gemma":0.001464225,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005311545,"about_ca_topic_score_gemma":0.005298614,"domain_scores_codex":[0.9998305,0.00004760555,0.000007134498,0.00003098878,0.00004907017,0.00003466193],"domain_scores_gemma":[0.9992751,0.0004360647,0.00008755502,0.00006211294,0.00008960407,0.0000495854],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004105892,0.00003590333,0.0003793482,0.0000261075,0.0000110104,0.00004164795,0.00004301576,0.9628998,0.002636441,0.007271738,0.0003212256,0.02629263],"study_design_scores_gemma":[0.000004599052,0.0000126992,0.00002217762,0.000001970718,0.000001865595,0.000003821455,0.00000324808,0.9977016,0.0004850103,0.001610749,0.0001508272,0.000001450086],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04286712,0.00008616017,0.9496205,0.0002731449,0.00002550079,0.00006203382,0.00003746876,0.001347673,0.005680331],"genre_scores_gemma":[0.8686908,0.00007361521,0.129168,0.000083411,0.00001092566,0.00007995414,0.00004187306,0.00006915562,0.001782311],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005311545,"threshold_uncertainty_score":0.01056129,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05025189694048924,"score_gpt":0.2804685489694158,"score_spread":0.2302166520289265,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}