Identifying patterns of co-occurring chronic conditions preceding dementia: An unsupervised machine learning approach using health administrative data
Notice bibliographique
Résumé
ObjectivesIndividual risk factors for dementia are well known, but the influence of co-occurring chronic conditions has not been considered. We identified clusters of chronic conditions using an unsupervised machine learning approach and examined associations with incident dementia. ApproachUsing linked population-based administrative databases, we followed all community-dwelling adults aged 40-54 years in Ontario, Canada from April 2002 until March 2019 for incident dementia. We estimated the prevalence of 29 chronic conditions using validated algorithms and/or diagnosis codes. We reduced dataset dimensionality using multiple correspondence analysis and a fuzzy c-means clustering algorithm identified the optimal number of clusters (between 3-6 tested). Associations between clusters and incident dementia were examined using a cause-specific hazard model adjusted for sociodemographic characteristics and accounting for the competing risk of death. ResultsWe identified 82,359 eligible individuals (random 3% sample of total eligible individuals; mean age 46.5 years; 50.4% female). Regression analyses were based on 5 comorbidity clusters (fuzzy silhouette index:0.69). Compared to the low comorbidity cluster, persons in the cerebrovascular disease/metabolic (HRadj=3.06, 95%CI[2.42,3.86]) and neuro-related/mental health clusters (HRadj=2.51, 95%CI[2.05,3.07]) had the highest rates of incident dementia, followed by the cardiovascular risk factor cluster (HRadj=1.66,95%CI[1.32,2.09]). Persons in the cancer cluster did not have an increased incidence of dementia (HRadj=0.96,95%CI[0.77,1.20]). ConclusionsWe found significant associations between machine learning-derived clusters of chronic conditions and dementia. ImplicationsUnsupervised machine learning approaches to identify clusters of chronic conditions may be a useful tool for considering the impact of multimorbidity on dementia risk.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,004 | 0,013 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,005 | 0,003 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».