Using spatio-temporal surveillance data to test the infectious environment of children before type 1 diabetes diagnosis
Notice bibliographique
Résumé
The "hygiene hypothesis" postulates that reduced exposure to infections favours the development of autoimmunity and childhood type 1 diabetes (T1D). But on the other side, viruses, notably enteroviruses, are suspected to trigger T1D. The assessment of the possible relationships between infections and T1D still defies the classical tools of epidemiology. We report the methods and results of a geographical approach that maps the addresses of patients to a communicable diseases surveillance database. We mapped the addresses of patients at birth, infancy and T1D diagnosis to the weekly estimates of the regional incidences of 5 frequent communicable diseases routinely collected since 1984 by the French Sentinel network. The pre-diagnostic infectious environment of 3548 patients with T1D diagnosed between 0.5 and 15 years was compared to those of 100 series of age-matched "virtual controls" drawn randomly on the map. Associations were classified as "suggestive" (summer diarrhea, SD, and varicella, V) when p< 0.05, or "significant" (influenza-like infections, ILI) when they passed the Bonferroni correction for FDR. Exposure to ILI and SD were associated with T1D risk, while V seemed protective. In the subset of 2521 patients for which we had genome wide data, we used a case-only approach to search for interactions between SNPs and the infectious environment as defined by the Sentinel database. Two SNPs, rs116624278 and rs77232854, showed significant interaction with exposure to V between 1 and 3 years of life. The infectious associations found should be taken as possible markers of patients' environment, not as direct causative factors of T1D. They require replication in other populations. The increasing public availability of geographical environmental databases will expand the present approach to map thousands of environmental factors to the lifeline of patients affected by various diseases.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,003 | 0,007 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,001 |
| Bibliométrie | 0,001 | 0,002 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,000 |
| Science ouverte | 0,000 | 0,001 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».