{"id":"W4391579662","doi":"10.1145/3597503.3623321","title":"FuzzSlice: Pruning False Positives in Static Analysis Warnings through Function-Level Fuzzing","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Fuzz testing; False positive paradox; Static analysis; Computer science; Function (biology); Pruning; Crash; Code (set theory); False positives and false negatives; Data mining; Machine learning; Software; Programming language; Set (abstract data type)","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00409829,0.002160077,0.001430183,0.003753339,0.001013386,0.002480253,0.002970891,0.002168242,0.006258661],"category_scores_gemma":[0.02048699,0.001225594,0.00160333,0.001455247,0.002036362,0.00471494,0.003479988,0.002267766,0.002580263],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008540538,"about_ca_system_score_gemma":0.001644062,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002919526,"about_ca_topic_score_gemma":0.004597879,"domain_scores_codex":[0.9951496,0.001075532,0.0003358962,0.0009022799,0.002118107,0.0004186199],"domain_scores_gemma":[0.9865716,0.007133618,0.0008994875,0.003811135,0.001318017,0.0002661105],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001727294,0.0003953234,0.01498917,0.0009187241,0.0004125204,0.001366008,0.001215448,0.05020962,0.08919828,0.02385085,0.03047342,0.7852433],"study_design_scores_gemma":[0.0002775142,0.0005348511,0.004991791,0.000344999,0.0003964771,0.001448645,0.0002553106,0.7485595,0.1674779,0.05075706,0.02474578,0.0002101845],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06163779,0.00109947,0.8451219,0.0007566542,0.0002878223,0.000290961,0.0008217047,0.08591338,0.004070345],"genre_scores_gemma":[0.3931751,0.0005804811,0.5885643,0.0008201631,0.000142642,0.0002711084,0.002350503,0.006791229,0.007304494],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006258661,"threshold_uncertainty_score":0.0216741,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04030937211425523,"score_gpt":0.3156704504588826,"score_spread":0.2753610783446274,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}