Robust prediction of water arsenic levels downstream of gold mines affected by acid mine drainage using hybrid ensemble machine learning and soft computing
Notice bibliographique
Résumé
Water pollution from hazardous materials, particularly arsenic, downstream of gold mines poses severe environmental and health risks. This study employs a systematic approach to predict water arsenic (WA) levels downstream of gold mines affected by acid mine drainage. WA data from the affected region were collected and preprocessed to standardize the dataset and mitigate overfitting risks. Advanced ensemble machine learning methods, particularly Light Gradient Boosting Machine (LightGBM), with two models developed: a manually-adjusted version and an optimization-based model using Jellyfish Search Optimizer (JSO). The performance of the LightGBM-JSO model was evaluated against a range of ensemble learning models, metaheuristic algorithms, and artificial intelligence techniques. Models were evaluated using mean absolute error (MAE), mean absolute percentage error (MAPE), coefficient of determination (R 2 ), root mean square error (RMSE), weighted mean absolute percentage error (WMAPE), mean relative error (MRE), scattered index (SI), ρ, and the Final Rating (FRa) methodology. The LightGBM-JSO outperformed other models, achieving a training phase MAE of 148.763, MAPE of 62.081, R 2 of 0.996, RMSE of 183.692, WMAPE of 0.08, SI of 0.097, ρ of 0.048, and MRE of − 0.379. In the testing phase, it had an MAE of 19.496, MAPE of 10.686, R 2 of 0.990, RMSE of 37.386, WMAPE of 0.136, SI of 0.241, ρ of 0.121, and MRE of 0.03. Uncertainty analysis confirmed the model's reliability with a prediction interval of ± 0.05 mg/L for arsenic concentration. This study provides evidence to support environmental management decisions, providing valuable insights for regulatory bodies, policymakers, and stakeholders to support sustainable mining practices. • Arsenic levels downstream of gold mines were predicted using advanced machine learning. • LightGBM-JSO outperformed other models in predicting arsenic contamination. • Comprehensive model evaluation confirmed high accuracy and reliability. • Study supports sustainable mining through evidence-based environmental management.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».