{"id":"W3028200206","doi":"10.1007/s10664-020-09837-4","title":"Do code review measures explain the incidence of post-release defects?","year":2020,"lang":"en","type":"article","venue":"Empirical Software Engineering","topic":"Software Engineering Research","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":false,"ca_institutions":"Concordia University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Operationalization; Code (set theory); Computer science; Replication (statistics); Code review; Replicate; Variable (mathematics); Empirical research; Contrast (vision); Econometrics; Statistics; Software; Software quality; Artificial intelligence; Mathematics; Software development; Programming language","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01127573,0.0005604706,0.0006285384,0.004925109,0.0004239523,0.002139952,0.001661362,0.001835693,0.004334835],"category_scores_gemma":[0.1810041,0.0005366016,0.001033177,0.003806828,0.001202436,0.003076121,0.0009574895,0.001788832,0.001039495],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008661799,"about_ca_system_score_gemma":0.001350121,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005785036,"about_ca_topic_score_gemma":0.009438024,"domain_scores_codex":[0.9923444,0.002240075,0.001132684,0.001089467,0.002406876,0.0007864712],"domain_scores_gemma":[0.5384732,0.2404041,0.182053,0.0175467,0.01634718,0.005175964],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001074885,0.00008627708,0.99232,0.00005481548,0.0001967927,0.00004091048,0.0001751154,0.0002676076,0.0002018376,0.0001790557,0.0003561841,0.00601395],"study_design_scores_gemma":[0.000008596455,0.0001044755,0.9978309,0.00003765348,0.00006558553,0.000080918,0.0001817047,0.0008608626,0.0002334586,0.0002694899,0.000315886,0.00001035983],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9937037,0.001204275,0.001541286,0.0007922967,0.00004816329,0.00002815654,0.0008260564,0.00006712048,0.001788877],"genre_scores_gemma":[0.9989005,0.0001121946,0.000220552,0.00006871433,0.0000237102,0.000009732918,0.0002975038,0.00002789455,0.0003391053],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9887243,"threshold_uncertainty_score":0.05963254,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0425573360393303,"score_gpt":0.2947060225830564,"score_spread":0.2521486865437261,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}