{"id":"W4414682428","doi":"10.26554/sti.2025.10.4.999-1011","title":"Decision Tree Algorithms in Water Quality Classification: A Comparative Study of Random Forest, XGBoost, and C5.0","year":2025,"lang":"en","type":"article","venue":"Science & Technology Indonesia","topic":"Water Quality Monitoring Technologies","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Decision tree; Random forest; Water quality; Preprocessor; Quality (philosophy); Random tree; Pipeline (software); Forage","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00942831,0.001909955,0.001824682,0.004558054,0.0008760794,0.00144882,0.001551106,0.001749207,0.0007734126],"category_scores_gemma":[0.01047439,0.0003972143,0.001432413,0.004440617,0.0005225049,0.002148627,0.0007237424,0.002081726,0.000504442],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001615091,"about_ca_system_score_gemma":0.002076207,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0282363,"about_ca_topic_score_gemma":0.0169402,"domain_scores_codex":[0.9955013,0.001832346,0.0003290768,0.0006107708,0.001271245,0.0004552539],"domain_scores_gemma":[0.9917127,0.005938759,0.0003458137,0.0002825821,0.001452892,0.0002672233],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001560019,0.0008981861,0.01642738,0.001023363,0.0006592209,0.0001081487,0.0001778465,0.3291426,0.001254647,0.003793124,0.01368354,0.631272],"study_design_scores_gemma":[0.00006777179,0.0005807422,0.005358182,0.0001866192,0.0001282907,0.00006075864,0.000128206,0.985931,0.001912299,0.002514432,0.003086098,0.00004548864],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.4633024,0.06658159,0.4365174,0.00444743,0.00215907,0.00095905,0.001900684,0.006970427,0.01716192],"genre_scores_gemma":[0.7357502,0.009721631,0.2462262,0.0009678139,0.0003608696,0.0003427931,0.003377439,0.0004298974,0.002823224],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.0282363,"threshold_uncertainty_score":0.05614388,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04732454753566626,"score_gpt":0.348229684982627,"score_spread":0.3009051374469607,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}