{"id":"W2913576447","doi":"10.1109/tifs.2019.2895963","title":"Large-Scale Empirical Study of Important Features Indicative of Discovered Vulnerabilities to Assess Application Security","year":2019,"lang":"en","type":"article","venue":"IEEE Transactions on Information Forensics and Security","topic":"Software Engineering Research","field":"Computer Science","cited_by":39,"is_retracted":false,"has_abstract":true,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Feature selection; Vulnerability (computing); Secure coding; Scale (ratio); Empirical research; Machine learning; Feature (linguistics); Data science; Predictive power; Focus (optics); Selection (genetic algorithm); Data mining; Artificial intelligence; Computer security; Information security; Software security assurance; Statistics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003787171,0.0009069342,0.0004860619,0.00507532,0.0004500701,0.0007056271,0.0005682365,0.0005140341,0.0005859559],"category_scores_gemma":[0.02921674,0.0001861049,0.0006209973,0.003491078,0.0006878462,0.001580638,0.000824908,0.001016292,0.0002020296],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004399593,"about_ca_system_score_gemma":0.0004737538,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001509349,"about_ca_topic_score_gemma":0.002362659,"domain_scores_codex":[0.9979486,0.000657369,0.0001951266,0.000357608,0.0007044896,0.0001368913],"domain_scores_gemma":[0.947002,0.04008443,0.006222642,0.003540975,0.002606322,0.0005435942],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002099442,0.0006567034,0.871029,0.0002284296,0.000351841,0.0002859193,0.0003372734,0.0335997,0.004430741,0.0006307461,0.001745032,0.08649477],"study_design_scores_gemma":[0.00002184234,0.0003841137,0.6855524,0.00006501048,0.0001940688,0.0006729605,0.0005033468,0.3008496,0.007686744,0.002721213,0.001299136,0.00004957821],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9850563,0.0003685359,0.01303317,0.0001196719,0.000009682165,0.00005548513,0.0006427576,0.0001639658,0.0005504781],"genre_scores_gemma":[0.9933081,0.00008880049,0.005722684,0.00001251048,0.000008226911,0.00003031371,0.0007384038,0.00001364807,0.00007730594],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00507532,"threshold_uncertainty_score":0.02002871,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01225166794696762,"score_gpt":0.2836587495156881,"score_spread":0.2714070815687205,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}