Développement et évaluation d’approches géostatistiques à l’échelle urbaine pour l’estimation de l’exposition aux particules fines et à l’ozone troposphérique
Notice bibliographique
Résumé
La pollution atmosphérique constitue un risque environnemental majeur dont les effets néfastes sur la santé et sur l’environnement sont déjà clairement démontrés. Toutefois, la mesure d’exposition des populations aux polluants tels que les particules fines et l’ozone troposphérique demeure approximative en raison de la faible densité des stations d’échantillonnage de ces polluants. Peu d’études ont considéré la variation spatiale intra-urbaine dans la modélisation spatiale des concentrations de polluants. Certaines études ont cependant combiné interpolation spatiale et corrélation avec des facteurs locaux. De plus, l’effet du régime météorologique (par exemple l’occurrence d’une inversion de température) sur l’amplitude de ces corrélations n’est pas pris en compte. Cette thèse a donc pour objectif d’évaluer de nouvelles manières de caractériser la distribution spatiale et temporelle des particules fines (PM2.5) et de l’ozone troposphérique (O3) à l’échelle intra-urbaine. Plus particulièrement, nous avons développé un modèle de géostatistique multivariable appelée krigeage avec dérive externe (KED, kriging with external drift) basé sur l’intégration de variables auxiliaires dans le processus d’estimation journalière des PM2.5 et de l’O3. Le krigeage constitue une forme d’interpolation spatiale des données de stations de mesures éparses, alors que la dérive externe mise sur des corrélations entre des conditions locales (axes de transport routier, espaces verts, etc.) et la concentration des polluants atmosphériques. Afin de prendre en compte les variations temporelles, notamment celles reliées aux conditions météorologiques, ces modèles ont été développés par groupes basés sur des conditions synoptiques et six classes d’états établies selon la température, le vent, l’humidité relative et les précipitations, d’après des données météorologiques journalières. Les résultats montrent que l’intégration des variables auxiliaires telles que la densité de la végétation et les zones des activités industrielles locales dans le KED expliquent en partie les variations intra-urbaines des PM2.5 de l’île de Montréal, mais que cet apport est variable selon la classe météorologique. Ainsi, lorsque les corrélations sont très faibles, une interpolation spatiale simple, comme la méthode IDW (inverse distance weighting) est plus exacte que l’interpolation multivariable, alors que pour d’autres conditions synoptiques le KED produit les prédictions les plus certaines. Nous avons pour cette raison proposé un modèle d’interpolation hybride (KED-IDW) s’adaptant aux conditions météorologiques. Nous avons également montré, particulièrement dans le cas de l’O3, que le krigeage avec dérive externe améliore les résultats obtenus par krigeage ordinaire (sans variables auxiliaires). Cette thèse a aussi permis d’évaluer l’apport d’un modèle spatio-temporel (BME, bayesian maximum entropy) dans l’estimation de l’effet à court terme de l’exposition à l’O3 sur les décès à Montréal. Les résultats suggèrent que ce modèle spatio-temporel dans les conditions développées (par ex. basé sur les données de 12 stations de mesures, pour un territoire de 1 310 km2) n’apporte pas de gains significatifs dans l’estimation de l’effet de l’exposition. Dans l’ensemble, cette thèse contribue au progrès de modélisation spatiale empirique des polluants atmosphériques en se fondant notamment sur l’adaptation aux conditions météorologiques et par l’ajout de certains facteurs météorologiques comme prédicteurs. Dans ce contexte, cette thèse ouvre une voie prometteuse pour l’amélioration des estimations de polluants atmosphériques à l’échelle intra-urbaine et de la capacité à évaluer les risques à la santé de la population par une meilleure caractérisation de l’exposition. Mots-clés : pollution de l’air, particules fines, ozone troposphérique, santé, géostatistique, krigeage avec dérive externe, environnement urbain.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,003 | 0,007 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,002 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,002 | 0,001 |
| Intégrité de la recherche | 0,002 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,003 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».