{"id":"W7126160705","doi":"10.18280/isi.301216","title":"A Comparative Analysis of Six Machine Learning Classifiers for Early-Stage Diabetes Risk Prediction Using a Kaggle Dataset","year":2025,"lang":"","type":"article","venue":"Ingénierie des systèmes d information","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"","funders":"","keywords":"Diabetes mellitus; Artificial neural network; Support vector machine; Interpretability; Pattern recognition (psychology)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","sts"],"consensus_categories":[],"category_scores_codex":[0.003282216,0.0005241712,0.001528514,0.002523127,0.003332949,0.0001752137,0.0004376575,0.0007472358,0.0002549537],"category_scores_gemma":[0.00350196,0.0005582041,0.0004144064,0.004166646,0.0005782235,0.003258453,0.0002682975,0.0013348,0.00004116962],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001646,"about_ca_system_score_gemma":0.001031489,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01300381,"about_ca_topic_score_gemma":0.003164105,"domain_scores_codex":[0.9921012,0.001682116,0.004148979,0.000466152,0.0005387453,0.001062814],"domain_scores_gemma":[0.9906433,0.002618645,0.003978645,0.0007121802,0.001809595,0.0002375901],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006394879,0.00009962321,0.7860093,0.005653129,0.002865563,3.408307e-7,0.07436063,0.1197934,0.0001644969,0.001320119,0.0007214061,0.008372565],"study_design_scores_gemma":[0.0004610066,0.0003925573,0.03970713,0.001578832,0.002688946,1.5012e-7,0.043267,0.903586,0.001000024,0.0005688355,0.006414091,0.000335426],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8598641,0.0006277252,0.09449963,0.00006811794,0.00137938,0.003579167,0.03919823,0.0001235512,0.0006601123],"genre_scores_gemma":[0.9854041,0.0002538415,0.001803386,0.0001730035,0.00009864596,0.0003372006,0.01177059,0.00002278234,0.0001364712],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7837926,"threshold_uncertainty_score":0.999687,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1111001010771972,"score_gpt":0.4079830580760702,"score_spread":0.2968829569988729,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}