{"id":"W4403785165","doi":"10.2139/ssrn.5000516","title":"Bugmentor: Generating Answers to Follow-Up Questions from Software Bug Reports Using Structured Information Retrieval and Neural Text Generation","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Software Engineering Research","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Computer science; Information retrieval; Natural language processing; Software; Artificial intelligence; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001656766,0.002224535,0.001116614,0.003381186,0.000531184,0.00106508,0.002250793,0.002208735,0.01694578],"category_scores_gemma":[0.01045059,0.0006025264,0.001161883,0.001325225,0.0004220474,0.001979738,0.001620561,0.001097367,0.006288626],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006876395,"about_ca_system_score_gemma":0.00102047,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003585692,"about_ca_topic_score_gemma":0.005308551,"domain_scores_codex":[0.9985607,0.0005054885,0.0001035198,0.0003730724,0.0003808531,0.00007638419],"domain_scores_gemma":[0.9951781,0.003261471,0.0003106897,0.0004080062,0.000681894,0.000159833],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001160742,0.0008193643,0.005204886,0.001657176,0.0002554151,0.0008021365,0.000820816,0.01665946,0.0395195,0.003261473,0.09117609,0.8386629],"study_design_scores_gemma":[0.0006771684,0.0009583735,0.004812908,0.0001478149,0.0002401328,0.0006300037,0.0005527056,0.8904791,0.0625692,0.01071299,0.02809032,0.0001292071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.08720914,0.0008974205,0.6690516,0.001049133,0.0005006505,0.00161564,0.01386093,0.2203372,0.005478381],"genre_scores_gemma":[0.2290613,0.0003236016,0.7278938,0.0003519414,0.0001710411,0.001096338,0.02869756,0.003072571,0.009331756],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01694578,"threshold_uncertainty_score":0.05668926,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0154761141132388,"score_gpt":0.2686534418935989,"score_spread":0.2531773277803601,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}