MétaCan
Menu
Retour à la cohorte
Enregistrement W2944472711 · doi:10.9778/cmajo.20180142

Developing a case definition for type 1 diabetes mellitus in a primary care electronic medical record database: an exploratory study

2019· article· en· W2944472711 sur OpenAlexaffvenueabout
Brendan Cord Lethebe, Tyler Williamson, Stephanie Garies, Kerry McBrien, Charles Leduc, Sonia Butalia, Boglárka Soós, Marta Shaw, Neil Drummond

Notice bibliographique

RevueCMAJ Open · 2019
Typearticle
Langueen
DomaineBiochemistry, Genetics and Molecular Biology
ThématiqueDiabetes and associated disorders
Établissements canadiensUniversity of Alberta
Organismes subventionnairesnon disponible
Mots-clésPrimary careType 2 Diabetes MellitusMedical recordElectronic health recordExploratory researchMedicineElectronic medical recordPatient recordDatabaseDiabetes mellitusFamily medicineComputer scienceMedical emergencyHealth careInternal medicineEndocrinologyPolitical science

Résumé

récupéré en direct d'OpenAlex

BACKGROUND: Identifying cases of disease in primary care electronic medical records (EMRs) is important for surveillance, research, quality improvement and clinical care. We aimed to develop and validate a case definition for type 1 diabetes mellitus using EMRs. METHODS: For this exploratory study, we used EMR data from the Southern Alberta Primary Care Network within the Canadian Primary Care Sentinel Surveillance Network (CPCSSN), for the period 2008 to 2016. For patients identified as having diabetes mellitus according to the existing CPCSSN case definition, we asked family physicians to confirm the diabetes subtype, to create the reference standard. We used 3 decision-tree classification algorithms and least absolute shrinkage and selection operator logistic regression to identify variables that correctly distinguished between type 1 and type 2 diabetes cases. RESULTS: We identified a total of 1309 people with type 1 or type 2 diabetes, 110 of whom were confirmed by their physicians as having type 1 diabetes. Two machine learning algorithms were useful in identifying these cases in the EMRs. The first algorithm used "type 1" text words or age less than 22 years at time of initial diabetes diagnosis; this algorithm had sensitivity 42.7% (95% confidence interval [CI] 33.5%-52.5%), specificity 99.3% (95% CI 98.6%-99.7%), positive predictive value 85.5% (95% CI 72.8%-93.1%) and negative predictive value 94.9% (95% CI 93.5%-96.1%). The second algorithm used a combination of free-text terms, insulin prescriptions and age; it had sensitivity 87.3% (95% CI 79.2%-92.6%), specificity 85.4% (95% CI 83.2%-87.3%), positive predictive value 35.6% (95% CI 29.9%-41.6%) and negative predictive value 98.6% (95% CI 97.7%-99.2%). INTERPRETATION: We used machine learning to develop and validate 2 case definitions that achieve different goals in distinguishing between type 1 and type 2 diabetes in CPCSSN data. Further validation and testing with a larger and more diverse sample are recommended.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,000
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,628
Score d'incertitude au seuil0,502

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0000,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,033
Tête enseignante GPT0,303
Écart entre enseignants0,270 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations22
Publié2019
Routes d'admission3
Résumé présentoui

Explorer davantage

Même revueCMAJ OpenMême sujetDiabetes and associated disordersTravaux en français237 207