Approches de modélisation des extrêmes dans l'étude des \nrelations entre la santé et la météo.
Notice bibliographique
Résumé
L’impact de la météo sur la santé humaine est reconnu et largement étudié. Toutefois, la grande \nmajorité des travaux qui s’y consacrent font usage de l’ensemble des observations, en se \nconcentrant sur le caractère global de l’impact qui se résume à travers la moyenne. Cela a pour \neffet de ne pas prendre en compte spécifiquement les phénomènes extrêmes tels que les pics \nsanitaires. Ces derniers représentent les extrêmes des variables sanitaires et surviennent à une \nfréquence rare, avec un impact fort sur le système de la santé publique. Leurs caractéristiques \nsont donc très différentes des phénomènes ordinaires. Ils nécessitent par conséquent des outils et \nexamens spécialisés, ce qu’une modélisation de l’ensemble des observations ne fournit \nhabituellement pas. De la même façon, les extrêmes météorologiques ne sont pas étudiés \nexclusivement en relation avec la santé dans un cadre de modélisation. Cette thèse a ainsi pour \nbut principal l’étude des valeurs extrêmes dans les relations entre la santé et les conditions \nmétéorologiques à l’aide d’outils statistiques appropriés. En premier lieu, la théorie des valeurs \nextrêmes couplée à des modèles de régression non-paramétriques permettent d’étudier en détail \nles pics sanitaires ainsi que leurs relations avec la météo (pas nécessairement extrême). Les \ndistributions extrêmes des pics sanitaires ainsi que les niveaux de retour associés sont en \nparticulier estimés. Ensuite, la régression quantile offre une vision alternative de ces relations, \ngrâce à un portrait complet évalué dans l’ensemble des quantiles de la distribution de la variable \nsanitaire. Elle met en lumière les impacts hétérogènes que peuvent avoir les variables \nmétéorologiques (pas nécessairement extrême) selon le quantile étudié. Finalement, la \nproblématique inverse est abordée, celle des extrêmes météorologiques. Ils peuvent survenir dans \nun contexte univarié (p. ex. température) ou multivarié (p. ex. température et humidité). Leurs \neffets sur la santé sont enfin analysés. Les résultats obtenus dans cette thèse montrent que les modèles contenant l’ensemble des observations et ceux sur les extrêmes (sanitaires ou \nmétéorologiques) sont différents à bien des égards. Il convient donc d’étudier les extrêmes \nspécifiquement et d’approfondir les techniques statistiques associées, particulièrement en \nrégression et dans un contexte de santé publique. Les applications sont effectuées dans les villes \nde Montréal et Québec (Canada) sur les maladies cardiovasculaires. The influence of meteorological conditions on human health is largely documented. Most of the \nstudies in this context use all events, summarizing them via the mean. This is necessary in order \nto understand global trends and everyday situations. However, the mean measures are not \nappropriate to comprehend specific events such as extreme events. For example, extremes of a \nhealth variable (sanitary peaks) very rarely occur but have an important impact on the public \nhealth system. Their characteristics are thus different from those of the mean events. This implies \nthat sanitary peaks require specialized tools and insights, which are not provided by a modeling \nof all the events. Likewise, meteorological extremes are not exclusively examined in relation to \nhealth in terms of modeling. Therefore, this thesis aims at studying extreme events in health and \nmeteorological conditions relationships using suitable statistical tools. The case studies are \ncardiovascular deaths and hospitalizations in Montréal and Québec (Canada). First, the extreme \nvalue theory paired with non-parametric regression techniques allow to study in detail sanitary \npeaks and their relationships with meteorological conditions (which are not necessarily extreme). \nThe sanitary peaks extreme distributions and the associated return levels are fitted. Then, quantile \nregression presents an alternative point view of these relationships through a different but more \ncomplete description. Indeed, quantile regression can detect heterogeneities in meteorological \neffects on the sanitary variable, depending on the studied quantile. Finally, the inverse problem is \nlooked at, i.e. the meteorological extremes. They can occur in a univariate (e.g. temperature) or \nmultivariate (e.g. temperature and humidity) context, therefore a correct identification is needed \nbefore analyzing their impacts on health. The obtained results of this thesis show that models \nusing all the observations and those using only extreme events (sanitary or meteorological) differ in many ways. Hence, specific studies on extremes and their associated statistical techniques are \nrequired, especially in regression in a public health context.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,005 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,003 | 0,002 |
| Science ouverte | 0,002 | 0,002 |
| Intégrité de la recherche | 0,003 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,005 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».