{"id":"W4206994298","doi":"10.1109/asew52652.2021.00017","title":"Toward a Smell-aware Prediction Model for CI Build Failures","year":2021,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"École de Technologie Supérieure; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Code smell; Computer science; Context (archaeology); Code (set theory); Quality (philosophy); Predictive modelling; Detector; Artificial intelligence; Reliability engineering; Machine learning; Software quality; Data mining; Engineering; Software; Programming language; Telecommunications; Software development","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002728548,0.002202827,0.001226284,0.005721329,0.0003655492,0.001556053,0.001484161,0.001392993,0.0007479692],"category_scores_gemma":[0.01082576,0.0005363117,0.001055245,0.002128953,0.000364689,0.001854959,0.001179143,0.001925509,0.001514601],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007194515,"about_ca_system_score_gemma":0.001215902,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009585964,"about_ca_topic_score_gemma":0.01053746,"domain_scores_codex":[0.9984013,0.000306195,0.000153437,0.0005752538,0.0003918551,0.0001719837],"domain_scores_gemma":[0.9911847,0.004480536,0.001369869,0.0006895982,0.001858461,0.0004168281],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006587377,0.000958322,0.3902,0.0006449012,0.0004057787,0.0006687066,0.0004109152,0.266423,0.01294834,0.001145188,0.02340367,0.3021325],"study_design_scores_gemma":[0.00001168173,0.0001027918,0.01720961,0.00003641085,0.0000462262,0.0001327334,0.00005120445,0.978049,0.002049752,0.001171565,0.001117244,0.00002180277],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5557884,0.003094087,0.4030757,0.001620853,0.0002261872,0.0002477882,0.01107335,0.0222141,0.00265955],"genre_scores_gemma":[0.8921537,0.0004308414,0.09253339,0.0002249274,0.0001235518,0.0001693121,0.01254363,0.0003334036,0.001487215],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009585964,"threshold_uncertainty_score":0.01906037,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03745704801880494,"score_gpt":0.2782276312020863,"score_spread":0.2407705831832814,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}