{"id":"W3010658448","doi":"10.1002/smr.2260","title":"Fuzzy case‐based‐reasoning‐based imputation for incomplete data in software engineering repositories","year":2020,"lang":"en","type":"article","venue":"Journal of Software Evolution and Process","topic":"Software Engineering Research","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"École de Technologie Supérieure","funders":"","keywords":"Missing data; Imputation (statistics); Categorical variable; Data mining; Computer science; Software; Fuzzy logic; Reuse; Machine learning; Artificial intelligence; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02175806,0.000749974,0.001807127,0.006500521,0.001580737,0.0033582,0.003949175,0.001938679,0.002171241],"category_scores_gemma":[0.07590329,0.0007013063,0.002219231,0.006335717,0.001368274,0.004366532,0.002424997,0.001865039,0.0005492689],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002255113,"about_ca_system_score_gemma":0.003012428,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009928925,"about_ca_topic_score_gemma":0.007081865,"domain_scores_codex":[0.9827855,0.008271579,0.001650704,0.001477552,0.005287102,0.000527552],"domain_scores_gemma":[0.9356114,0.03999206,0.006050608,0.009574772,0.008197777,0.0005732951],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008099537,0.0007766628,0.04140466,0.0008943445,0.0008220514,0.001693276,0.001916351,0.516613,0.002963771,0.03462321,0.006317908,0.3911649],"study_design_scores_gemma":[0.00004325858,0.00006671569,0.003768181,0.0001726632,0.0001024611,0.0002790173,0.0002815406,0.9651766,0.003265916,0.0247451,0.002036199,0.00006229805],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.07303965,0.0004791828,0.9225016,0.0006858653,0.00007487127,0.0002037898,0.0004229777,0.0007852689,0.001806772],"genre_scores_gemma":[0.6162519,0.0003240413,0.3811141,0.000144615,0.00004163919,0.0002524503,0.001040888,0.00005975436,0.0007705331],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02175806,"threshold_uncertainty_score":0.115069,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03250375646217073,"score_gpt":0.2970636970608757,"score_spread":0.2645599405987049,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}