{"id":"W4412017252","doi":"10.18280/isi.300505","title":"SMOTE-ENN Resampling to Optimize Diabetes Prediction in Imbalanced Data","year":2025,"lang":"fr","type":"article","venue":"Ingénierie des systèmes d information","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Resampling; Computer science; Artificial intelligence; Machine learning; Data mining; Pattern recognition (psychology)","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004422945,0.0009577278,0.0008538183,0.0008286798,0.0004129548,0.0006782845,0.0007470061,0.0005917315,0.0007306199],"category_scores_gemma":[0.008235249,0.0003042424,0.001037355,0.0004889425,0.0003307775,0.0007656321,0.0006323812,0.001219426,0.0003251096],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005664164,"about_ca_system_score_gemma":0.00139687,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01186018,"about_ca_topic_score_gemma":0.01393906,"domain_scores_codex":[0.9992152,0.0003109248,0.00006240084,0.0001811518,0.0001244481,0.0001057462],"domain_scores_gemma":[0.9982108,0.001008566,0.0001375909,0.0001382221,0.0004507738,0.00005411476],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007662401,0.0004015751,0.02947133,0.000230901,0.0004625856,0.0001563666,0.000182657,0.7016047,0.007591137,0.002499507,0.00551921,0.2511138],"study_design_scores_gemma":[0.00001939215,0.00007563541,0.002883913,0.00001803576,0.00002735076,0.00001984718,0.00003437608,0.9932281,0.002077908,0.0007815048,0.0008256492,0.000008282604],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3473813,0.001579271,0.6433078,0.0007486676,0.0003393334,0.0002404832,0.0008731034,0.002988885,0.002541129],"genre_scores_gemma":[0.7856824,0.0002813137,0.208718,0.0003976917,0.00008463793,0.0002076256,0.002759013,0.0001689648,0.001700292],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01186018,"threshold_uncertainty_score":0.02358234,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0928380235529106,"score_gpt":0.399481683025284,"score_spread":0.3066436594723734,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}