Représentativité et généralisation d’estimations de séroprévalence des anticorps contre le SRAS-CoV-2 dans la population pédiatrique montréalaise
Notice bibliographique
Résumé
Les études de séroprévalence portant sur les infections au SRAS-CoV-2 doivent souvent composer avec des échantillons non-aléatoires et non-représentatifs, limitant ainsi parfois la validité externe de leurs résultats lorsque ceux-ci sont appliqués à la population générale. Dans le cadre de ce mémoire, il s’agit d’investiguer la représentativité d’une cohorte pédiatrique d’une étude longitudinale de séroprévalence (Enfants et COVID-19 : Étude de séroprévalence) et d’évaluer dans quelle mesure ses estimations de séroprévalence peuvent s’appliquer à la population pédiatrique montréalaise en général. 1 632 enfants ont fourni au point de départ un échantillon sanguin afin de déterminer leur séropositivité aux anticorps contre le SRAS-CoV-2. À l’aide d’une modélisation par régression logistique et d’un procédé de « standardisation marginale », une pondération post-stratification calculée à partir des données du recensement canadien de 2016 a été appliquée à la population d’étude. Les variations dans les estimations de séroprévalence ont finalement été évaluées. D’importantes différences dans la distribution de certaines caractéristiques sociodémographiques peuvent être observées lorsqu’on compare la population d’étude et la population générale en se basant sur les données du recensement canadien de 2016. En comparaison des estimations non-pondérées, les estimations de séroprévalence générées à partir du procédé de « standardisation marginale » montrent une variation de plusieurs points de pourcentage, allant de -0,4% à +3,2%. La pondération n’a pas induit de changement dans l’estimation de mesures relatives comme les ratios de séroprévalence. Lorsque la population d’étude est non-représentative de la population-cible, il est nécessaire de pondérer les caractéristiques sociodémographiques associées à l’issue si l’on veut appliquer les résultats plus généralement.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,009 | 0,020 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,003 | 0,003 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,003 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».