{"id":"W4255479603","doi":"10.1109/icse.1998.671609","title":"An investigation on the use of machine learned models for estimating correction costs","year":2002,"lang":"en","type":"article","venue":"","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"Computer Research Institute of Montréal; University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada; China Scholarship Council","keywords":"Reuse; Computer science; Software; Division (mathematics); Fault (geology); Asset (computer security); Product (mathematics); Artificial intelligence; Machine learning; Software engineering; Reliability engineering; Data mining; Engineering; Mathematics; Programming language","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01450044,0.001216258,0.0008151433,0.002291331,0.0005106761,0.001637219,0.001512222,0.001346476,0.0008491401],"category_scores_gemma":[0.1235612,0.0003866749,0.000683261,0.002138442,0.0007651906,0.003520962,0.0005709237,0.001514202,0.0002665086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001394538,"about_ca_system_score_gemma":0.001190129,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008813408,"about_ca_topic_score_gemma":0.006350423,"domain_scores_codex":[0.9923806,0.005188583,0.0003417317,0.0006802306,0.001181196,0.000227558],"domain_scores_gemma":[0.8201796,0.1587921,0.005252509,0.009173853,0.006256531,0.0003454389],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007228812,0.0006615354,0.06542122,0.0002020903,0.0003257218,0.0001071094,0.00022533,0.6759778,0.002026377,0.004858013,0.001059516,0.2484123],"study_design_scores_gemma":[0.00001990949,0.000165861,0.00469675,0.00001852361,0.00002801782,0.0000703804,0.00005072125,0.9903634,0.001818735,0.002338218,0.0004123756,0.00001716039],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5692069,0.001283609,0.4232393,0.001339363,0.00006556592,0.0001564922,0.0004772826,0.001059638,0.003171962],"genre_scores_gemma":[0.9113199,0.0002297775,0.08757762,0.00009351366,0.00003371275,0.00005715683,0.000284333,0.00005310745,0.0003510294],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01450044,"threshold_uncertainty_score":0.07668656,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1874663520856673,"score_gpt":0.3045913298393083,"score_spread":0.1171249777536409,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}