{"id":"W2367798545","doi":"10.1145/2884781.2884857","title":"Automated parameter optimization of classification techniques for defect prediction models","year":2016,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":344,"is_retracted":false,"has_abstract":true,"ca_institutions":"Queen's University; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Classifier (UML); Machine learning; Artificial intelligence; Random forest; Predictive modelling; Software bug; Decision tree; Software; Data mining","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007277756,0.002870057,0.001574829,0.003175426,0.0007531903,0.00196185,0.002104119,0.00197544,0.001847662],"category_scores_gemma":[0.04490184,0.001002309,0.00193185,0.001999069,0.0009102629,0.003259906,0.001386397,0.00350648,0.001482825],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001515643,"about_ca_system_score_gemma":0.001819798,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005024496,"about_ca_topic_score_gemma":0.006628972,"domain_scores_codex":[0.995197,0.002202398,0.0004477397,0.001040089,0.0007810402,0.0003317997],"domain_scores_gemma":[0.9770182,0.01479877,0.002094802,0.003482356,0.002430299,0.0001755959],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003095445,0.0004776222,0.01534832,0.0002549603,0.0004130541,0.0001368248,0.0002749333,0.5643507,0.008706163,0.002329685,0.005803585,0.4015945],"study_design_scores_gemma":[0.00003629774,0.0001321116,0.002359797,0.00004737984,0.00005825325,0.0001053423,0.00007488851,0.984273,0.006513645,0.004691003,0.001666236,0.00004215843],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1230998,0.001195142,0.8607571,0.0007108875,0.0001391972,0.0005794632,0.0006138244,0.01027538,0.002629149],"genre_scores_gemma":[0.620587,0.0004477721,0.3737784,0.0003411524,0.00008191269,0.000867084,0.001729406,0.0008540303,0.00131312],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007277756,"threshold_uncertainty_score":0.03848892,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03975154568969916,"score_gpt":0.2891461855171243,"score_spread":0.2493946398274251,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}