{"id":"W4312422135","doi":"10.1145/3510457.3513039","title":"How does code reviewing feedback evolve?","year":2022,"lang":"en","type":"article","venue":"","topic":"Software Engineering Research","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo; Polytechnique Montréal; McGill University","funders":"Mitacs","keywords":"Code review; Computer science; Code (set theory); Context (archaeology); Process (computing); Generalizability theory; Premise; Replicate; Static program analysis; Software; Knowledge management; Software development; Software engineering; Psychology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07908302,0.0006125783,0.001141417,0.009485941,0.002741444,0.01019513,0.002379801,0.00314407,0.002043273],"category_scores_gemma":[0.4865092,0.001070641,0.0008583835,0.007396468,0.002553752,0.01260435,0.003191952,0.001894167,0.001901614],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00529045,"about_ca_system_score_gemma":0.007463214,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0120884,"about_ca_topic_score_gemma":0.01434889,"domain_scores_codex":[0.8887028,0.05386294,0.008357759,0.01342382,0.03166845,0.003984251],"domain_scores_gemma":[0.3479275,0.3789596,0.1066779,0.03378427,0.1236395,0.009011141],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003116761,0.0003439437,0.598469,0.0008744408,0.0003081139,0.0003673871,0.03596685,0.001710544,0.002160292,0.003230812,0.009837877,0.3464191],"study_design_scores_gemma":[0.00006555484,0.0006767393,0.9079638,0.001332933,0.0002363024,0.0011327,0.02533111,0.01226757,0.002706369,0.009036086,0.03894062,0.0003103602],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9229411,0.005434452,0.02270276,0.01984181,0.0005995948,0.0005398904,0.001023676,0.00124413,0.02567252],"genre_scores_gemma":[0.9892421,0.0009271995,0.005816774,0.001109648,0.0002422288,0.0001500537,0.000395901,0.0002635036,0.001852601],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.920917,"threshold_uncertainty_score":0.418236,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02717132600680183,"score_gpt":0.2577381481836016,"score_spread":0.2305668221767997,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}