{"id":"W4392448159","doi":"10.2139/ssrn.4749139","title":"Ensemble Machine Learning Using Hydrometeorological Information to Improve Modelling of Quality Parameter of Raw Water Supplying Treatment Plants","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Water Quality Monitoring Technologies","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Université Laval","funders":"","keywords":"Hydrometeorology; Quality (philosophy); Computer science; Ensemble learning; Water quality; Machine learning; Artificial intelligence; Meteorology; Geography","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.002678748,0.0003586441,0.0006285783,0.0002577695,0.0001218999,0.00007592013,0.0005022595,0.0003489082,0.00002964276],"category_scores_gemma":[0.00008717013,0.0002460817,0.0002537551,0.0001112475,0.0001076623,0.0002068561,0.00141436,0.002574209,0.00004048588],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002596074,"about_ca_system_score_gemma":0.0001705341,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003270377,"about_ca_topic_score_gemma":0.00008803184,"domain_scores_codex":[0.9962658,0.0002376088,0.001061112,0.000369156,0.0005448149,0.001521543],"domain_scores_gemma":[0.9989531,0.00009304863,0.0004744282,0.0003792564,0.00002532773,0.00007485215],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0002141647,0.00009771813,0.003785235,0.0001318507,0.0002733403,0.000003871457,0.002356942,0.8547665,0.1215382,0.0002998182,0.000001377245,0.0165309],"study_design_scores_gemma":[0.0006153146,0.001618118,0.00011039,0.0002064009,0.0001900634,0.000116696,0.001094717,0.1014836,0.5696583,0.3241672,0.0001053322,0.0006339339],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9570865,0.0002039855,0.04172705,0.0001914388,0.0002721447,0.0003732741,0.0000217568,0.00007989352,0.00004397351],"genre_scores_gemma":[0.9941928,0.0004421351,0.005162216,0.000008108021,0.000047191,0.00001972396,0.00002523656,0.00002425498,0.00007832953],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.753283,"threshold_uncertainty_score":0.9999992,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05049784743509739,"score_gpt":0.2884964475075255,"score_spread":0.2379986000724281,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}