HearteXplain: explainable prediction of acute heart failure and identification of hematologic biomarkers using EBMs and Morris sensitivity analysis
Notice bibliographique
Résumé
Hematological biomarkers have emerged as powerful tools in diagnosing Acute Heart Failure (AHF). This study introduces a novel diagnostic framework that integrates Explainable Artificial Intelligence (XAI) with Morris Sensitivity Analysis (MSA) to enhance both the interpretability and performance of machine learning models in AHF detection. A dataset consisting of 425 AHF patients and 430 controls was analyzed using eight machine learning models, including XGBoost, Histogram-based Gradient Boosting (histGB), Explainable Boosting Machine (EBM), and Random Forest. Model performance was evaluated through metrics such as AUC, accuracy, precision, recall, and Brier score. Hyperparameters were optimized via Bayesian optimization. Feature importance was assessed using MSA to identify variables with the highest predictive influence. The histGB model achieved the highest performance with an AUC of 87.93%. Both MSA and EBM consistently identified PDW, RDW-CV, NEU, NEU/LY ratio, age, and WBC as top predictive features across multiple models. These hematological markers demonstrated strong potential for early diagnosis and risk stratification in AHF patients. This study presents a clinically relevant, interpretable, and cost-effective diagnostic strategy that combines XAI with MSA for AHF prediction. The framework enhances clinical trust and provides a pathway toward personalized treatment by identifying accessible hematological biomarkers. The integration of explainability into AI models improves their transparency and applicability in real-world clinical settings.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,004 | 0,010 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,002 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».