Predicting Postoperative Delirium in Older Patients: a multicenter retrospective cohort study
Notice bibliographique
Résumé
Abstract Background The number of elective surgeries for older individuals is on the rise globally. Machine learning may improve risk assessment with an impact on surgical planning and postoperative care. Preoperative cognitive assessment may facilitate early identification of postoperative delirium (POD). This study aims to estimate the predictive ability of machine learning models for POD using pre-and/or perioperative features, with a specific focus on adding neuropsychological assessments prior to surgery. Materials and Methods This retrospective cohort study analyzed data from the multicenter PAWEL study and its PAWEL-R substudy, encompassing older patients (≥70 years) undergoing elective surgeries across five medical centers from July 2017 to April 2019. A total of 1624 patients were included, with POD diagnosis made before discharge. Data included demographics, clinical, surgical, and neuropsychological features collected pre- and perioperatively. Machine learning model performance was evaluated using the area under the receiver operating characteristic curve (AUC), with permutation testing for significance and SHapley Additive exPlanations (SHAP) to identify effective neuropsychological assessments. Results In this cohort of 1624 patients, 52.3% (N=850) were male, with a mean [SD] age of 77.9 [4.9] years. Predicting POD before surgery using demographic, clinical, surgical, and neuropsychological features achieved an AUC of 0.79. Incorporating all pre- and perioperative features into the model yielded a slightly higher AUC of 0.82, with no significant difference observed ( P = .19). Notably, cognitive factors alone were not strong predictors (AUC=0.61). However, specific tests within neuropsychological assessments, such as the Montreal Cognitive Assessment memory subdomain and Trail Making Test Part B, were found to be crucial for prediction according to SHAP analysis. Conclusion and Relevance Preoperative risk prediction for POD can increase risk awareness in presurgical assessment and improve postoperative management in patients with a high risk for delirium. Highlights Analyzed 1624 older patients (≥70 years) undergoing elective surgeries across five medical centers from July 2017 to April 2019. Established machine learning model to predict postoperative delirium before surgery. Preoperative cognition enhances predictive performance, comparable to models incorporating all pre- and perioperative features. Montreal Cognitive Assessment memory subdomain and Trail Making Test Part B drive the cognition-based prediction. Perioperative surgical features, such as the duration of the surgery, are important predictors.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,003 | 0,007 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».