{"id":"W2094656673","doi":"10.5430/air.v4n1p22","title":"Diagnostic with incomplete nominal/discrete data","year":2015,"lang":"en","type":"article","venue":"Artificial Intelligence Research","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Missing data; Computer science; Imputation (statistics); Data mining; Decision tree; Cartesian product; Machine learning; Bayesian probability; Naive Bayes classifier; Outcome (game theory); Artificial intelligence; Mathematics; Support vector machine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01380194,0.001107303,0.001712789,0.004253807,0.001014609,0.002863159,0.002809779,0.001874711,0.003320988],"category_scores_gemma":[0.05511297,0.0004141898,0.001184886,0.003633612,0.001335438,0.002593926,0.002708159,0.002552916,0.001578656],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001225483,"about_ca_system_score_gemma":0.002285237,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00158388,"about_ca_topic_score_gemma":0.001665773,"domain_scores_codex":[0.9893315,0.004896371,0.0009804034,0.001685494,0.002679311,0.0004269302],"domain_scores_gemma":[0.9500855,0.03245361,0.004850421,0.007526323,0.004254113,0.0008300542],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001406938,0.0005248523,0.07139182,0.002058666,0.0005027633,0.002058183,0.00129049,0.07460218,0.004508927,0.06548593,0.03012573,0.7460436],"study_design_scores_gemma":[0.0001557038,0.000318564,0.01140929,0.0007058074,0.0001797881,0.003019245,0.001475346,0.6807174,0.01404017,0.2540601,0.03379653,0.0001219754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02803367,0.00188537,0.9610497,0.0025708,0.000316115,0.0002255261,0.001663027,0.001321163,0.002934637],"genre_scores_gemma":[0.3843017,0.001649,0.6050982,0.00084451,0.0005516471,0.0003520015,0.004149411,0.0001452947,0.00290825],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01380194,"threshold_uncertainty_score":0.07299244,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5670274782417085,"score_gpt":0.4842737624100367,"score_spread":0.08275371583167185,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}