Machine Learning-Augmented Traditional Analysis: Lactate versus Lactate-to-Albumin Ratio in Predicting Mortality Risk among Septic Patients — A Large-scale Retrospective Study (Preprint)
Notice bibliographique
Résumé
<sec> <title>BACKGROUND</title> Effective risk stratification in sepsis remains a clinical challenge. While lactate is a cornerstone biomarker, its predictive limitations are well-known. The lactate-to-albumin ratio (LAR) has emerged as a promising alternative, but its superiority, particularly in patients without severe hyperlactatemia, has not been rigorously validated in a large cohort using advanced, transparent methodologies. </sec> <sec> <title>OBJECTIVE</title> To determine whether the lactate-to-albumin ratio (LAR) provides superior and more robust prediction of 28-day mortality than lactate alone in adult sepsis patients, through comprehensive analysis using threshold effects, restricted cubic splines, and interpretable machine learning models in a large multicenter cohort. </sec> <sec> <title>METHODS</title> We conducted a retrospective analysis of 3637 adult sepsis patients from the multicenter eICU database. The primary outcome was 28-day mortality. We employed a dual approach: 1. Traditional statistical analyses, including threshold and restricted cubic spline modeling, to compare the predictive behavior of lactate and LAR. 2. Development of nine machine learning models to assess their predictive performance. We used SHapley Additive exPlanations (SHAP) to provide full model interpretability and to quantify the precise predictive contribution of each biomarker. </sec> <sec> <title>RESULTS</title> LAR consistently demonstrated a stronger and more stable association with mortality than lactate, especially in patients with lactate levels <4 mmol/L. In machine learning analyses, the top-performing Extreme Gradient Boosting (XGBoost) model achieved an AUC of 0.71 for 28-day in-hospital mortality. Critically, SHAP analysis revealed that LAR was consistently ranked as one of the top three most important predictive features across all models, with a contribution quantitatively greater than that of lactate alone. </sec> <sec> <title>CONCLUSIONS</title> The LAR is a superior and more robust biomarker than lactate for sepsis mortality prediction. By integrating a measure of acute metabolic distress (lactate) with a marker of systemic inflammation and capillary leak (albumin), LAR provides a more comprehensive risk assessment, particularly in the crucial early stages of sepsis. Interpretable machine learning models powered by LAR offer a promising pathway toward more precise and reliable clinical decision support. </sec> <sec> <title>CLINICALTRIAL</title> .Database access complied with the PhysioNet review board's data use agreement and HIPAA Safe Harbor provisions. This study received an exemption from the Massachusetts Institute of Technology Institutional Review Board, and the researcher completed the required data access training certification(Xu Yi, Certificate No.66014966). </sec>
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Étiquettes directes de modèles (non validées)
Étiquettes de catégorie et de devis d'étude par modèle, issues des rondes d'étiquetage. C'est une sortie machine, non validée, et le désaccord entre modèles est livré comme donnée. Aucun devis ici n'est encore validé contre MEDLINE.
| Bras | Catégories | Devis d'étude | Confiance |
|---|---|---|---|
| gemma | aucune catégorie Domaine: non disponible · Genre: Empirique Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non | Observationnel | low |
| gpt | aucune catégorie Domaine: non disponible · Genre: Empirique Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non | Observationnel | low |
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,004 | 0,005 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,001 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéeÉtiqueté directement par 2 modèles lisant le dossier complet.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».