{"id":"W3000602293","doi":"10.1109/tcad.2020.2966448","title":"Searching for Bugs Using Probabilistic Suspect Implications","year":2020,"lang":"en","type":"article","venue":"IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems","topic":"Software Engineering Research","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Debugging; Suspect; Computer science; Probabilistic logic; Set (abstract data type); Machine learning; Hyperparameter; Algorithmic program debugging; Artificial intelligence; Software bug; Data mining; Programming language; Software","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001419399,0.0009161644,0.0006145039,0.00340373,0.0005475837,0.001138258,0.001426409,0.0009936255,0.00268113],"category_scores_gemma":[0.01536543,0.0005506764,0.0008086606,0.001116293,0.0006865096,0.00258749,0.001137122,0.00106697,0.0003957424],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008228947,"about_ca_system_score_gemma":0.001414167,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004892151,"about_ca_topic_score_gemma":0.01153109,"domain_scores_codex":[0.9989914,0.0002308751,0.00006741744,0.0002607811,0.0003694426,0.00008014683],"domain_scores_gemma":[0.990905,0.006629077,0.00092642,0.000520407,0.000886129,0.0001329225],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006651451,0.000294032,0.09512095,0.0004166263,0.0001247623,0.0008340779,0.0007515766,0.36745,0.009053805,0.01502075,0.005663679,0.5046045],"study_design_scores_gemma":[0.00002265373,0.00006948395,0.002312424,0.0000363985,0.00003130648,0.0001874345,0.00007343568,0.9786734,0.002565803,0.01530829,0.0007043138,0.00001501944],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2645853,0.0007264758,0.7234868,0.001298296,0.00004053731,0.000158112,0.0008179267,0.006102312,0.002784232],"genre_scores_gemma":[0.8456114,0.0001557763,0.1522778,0.000121609,0.00001916422,0.00005661129,0.0006508368,0.0001285592,0.0009781957],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004892151,"threshold_uncertainty_score":0.009727359,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1022860982032533,"score_gpt":0.2892106682700945,"score_spread":0.1869245700668411,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}