{"id":"W4402352815","doi":"10.1109/ijcnn60899.2024.10650368","title":"Knowledge-Informed Auto-Penetration Testing Based on Reinforcement Learning with Reward Machine","year":2024,"lang":"en","type":"article","venue":"","topic":"Software Testing and Debugging Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada; Concordia University","keywords":"Reinforcement learning; Computer science; Penetration (warfare); Machine learning; Artificial intelligence; Reinforcement; Psychology; Engineering; Social psychology; Operations research","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001808051,0.00111499,0.001310065,0.0005802769,0.0004194356,0.000727964,0.001840005,0.001161866,0.001811661],"category_scores_gemma":[0.009015256,0.0005813401,0.0005916883,0.0003795039,0.001381451,0.001544687,0.001566388,0.001665868,0.0002641464],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001037366,"about_ca_system_score_gemma":0.002181948,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005396568,"about_ca_topic_score_gemma":0.004050356,"domain_scores_codex":[0.9986344,0.0005014436,0.00006602168,0.0003058894,0.0002684023,0.0002237864],"domain_scores_gemma":[0.9944742,0.003618213,0.0006263498,0.0004716624,0.0005531296,0.0002564536],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008585272,0.00007571832,0.001473614,0.00004719592,0.00002389031,0.00009883774,0.00005401182,0.9466687,0.001396232,0.004478327,0.0005104218,0.0450872],"study_design_scores_gemma":[0.000007455676,0.00002560181,0.00006747443,0.000003187088,0.000003242784,0.00001013343,0.000002965383,0.9978393,0.000454923,0.001504417,0.00007816519,0.000002980398],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07202718,0.0001937501,0.9231459,0.0003363283,0.00003037391,0.00009485499,0.00005758867,0.002171757,0.001942361],"genre_scores_gemma":[0.9418698,0.00005280709,0.05697531,0.0001218544,0.0000106308,0.00009625131,0.0000636047,0.00007099361,0.0007387055],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005396568,"threshold_uncertainty_score":0.01073033,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03125521645134659,"score_gpt":0.28878440336497,"score_spread":0.2575291869136234,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}