{"id":"W2752925099","doi":"10.6000/1927-5129.2017.13.77","title":"Analyzing Diabetes Datasets using Data Mining","year":2017,"lang":"en","type":"article","venue":"Journal of Basic & Applied Sciences","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":29,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Naive Bayes classifier; Computer science; Diabetes mellitus; Data mining; Domain (mathematical analysis); Random forest; Data set; Data science; Medicine; Artificial intelligence; Machine learning; Support vector machine; Mathematics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001596733,0.000874807,0.0009175718,0.005708876,0.0008159081,0.001701745,0.001395959,0.001271415,0.00293233],"category_scores_gemma":[0.005001769,0.0002111559,0.001356864,0.006195118,0.0002330985,0.000765001,0.0009023675,0.001253121,0.00152313],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001049049,"about_ca_system_score_gemma":0.001376259,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006255427,"about_ca_topic_score_gemma":0.007500859,"domain_scores_codex":[0.9982643,0.0001932465,0.000396407,0.0003944107,0.0005438128,0.0002079077],"domain_scores_gemma":[0.9975361,0.0009739941,0.0003452882,0.0003984649,0.0005752561,0.0001708215],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002915207,0.003731574,0.2509826,0.003469356,0.001029644,0.00302865,0.0003913439,0.03493873,0.006483315,0.003698086,0.1547605,0.534571],"study_design_scores_gemma":[0.0007176768,0.001860436,0.3089215,0.001284282,0.0007409005,0.004877341,0.003022489,0.2851319,0.03319493,0.01421601,0.3456878,0.0003448081],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.3581029,0.004623276,0.03113708,0.004180145,0.000934338,0.002389608,0.5809017,0.00598338,0.01174748],"genre_scores_gemma":[0.3295758,0.002229787,0.08003198,0.0007421711,0.0002842807,0.00173633,0.581817,0.0001153357,0.003467305],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006255427,"threshold_uncertainty_score":0.012438,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.4432978032849009,"score_gpt":0.5419335777827297,"score_spread":0.09863577449782873,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}