{"id":"W2202127834","doi":"10.1109/iccd.2015.7357081","title":"Clustering-based revision debug in regression verification","year":2015,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Debugging; Computer science; Ranking (information retrieval); Cluster analysis; Overhead (engineering); Automation; Rank (graph theory); Data mining; Algorithmic program debugging; Machine learning; Reliability engineering; Programming language; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005124276,0.001028111,0.001537421,0.003791203,0.001162951,0.001399906,0.002331972,0.001168545,0.001533805],"category_scores_gemma":[0.0227866,0.0005912508,0.0008575664,0.002004747,0.0011773,0.002008625,0.001799963,0.001138404,0.0006283835],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001270683,"about_ca_system_score_gemma":0.002320071,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005839731,"about_ca_topic_score_gemma":0.009450653,"domain_scores_codex":[0.9960405,0.001536821,0.0002513783,0.0007632165,0.001025467,0.0003827544],"domain_scores_gemma":[0.9853498,0.006542916,0.002000312,0.002991557,0.002646946,0.0004685359],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006725324,0.0002860682,0.01726316,0.0001941823,0.0001191705,0.0002439892,0.0005781861,0.4902384,0.008636047,0.01356209,0.002896254,0.46531],"study_design_scores_gemma":[0.00003795879,0.0001585824,0.001759354,0.00002187697,0.00003178215,0.0001160305,0.0001030163,0.9817831,0.005636601,0.008888498,0.001430346,0.00003294625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1114332,0.0006390064,0.8792111,0.0002481595,0.0000754185,0.0001978976,0.0001700046,0.006349098,0.001676043],"genre_scores_gemma":[0.6715647,0.0001502283,0.3257863,0.00008143029,0.00003527609,0.0001005432,0.0003715782,0.0003331662,0.001576803],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.005839731,"threshold_uncertainty_score":0.02710009,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0510991814935841,"score_gpt":0.3141047332282426,"score_spread":0.2630055517346585,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}