MétaCan
Menu
Back to cohort
Record W7006763481

Utilisation de l’apprentissage automatique pour approximer l’énergie d’échange-corrélation

2024· dissertation· fr· W7006763481 on OpenAlexfundno aff

Bibliographic record

VenuePapyrus : Institutional Repository (Université de Montréal) · 2024
Typedissertation
Languagefr
FieldMaterials Science
TopicMachine Learning in Materials Science
Canadian institutionsnot available
FundersFonds de recherche du Québec – Nature et technologiesNatural Sciences and Engineering Research Council of CanadaFonds Québécois de la Recherche sur la Nature et les TechnologiesCompute Canada
KeywordsDerogationContext (archaeology)ESPACE
DOInot available

Abstract

fetched live from OpenAlex

Le sujet de cette thèse est le développement de nouvelles approximations à l’énergie d’échange-corrélation (XC) en théorie de la fonctionnelle de la densité (DFT). La DFT calcule l’énergie électronique d’une molécule à partir de la densité électronique, une quantité qui est considérablement plus simple que la fonction d’onde. Cette théorie a été développée durant les années 1960 et elle est devenue la méthode de choix en chimie quantique depuis 1990, grâce à un ratio coût/précision très favorable. En pratique, la DFT est utilisée par les chercheurs et l’industrie pour prédire des spectres infrarouges, la longueur des liens chimiques, les barrières d’activation, etc. Selon l’approche Kohn-Sham, seulement le terme de l’énergie XC est inconnu et doit être approximé. Les chapitres de ce texte sont des articles consacrés au développement d’approches non locales et à l’utilisation de l’apprentissage automatique pour améliorer la précision et/ou la rapidité des calculs de l’énergie XC. Le premier article de cette thèse concerne le développement d’approximations non locales au trou XC [Cuierrier, Roy, et Ernzerhof, JCP (2021)]. Notre groupe de recherche a précédemment développé la méthode du facteur de corrélation (CFX) [Pavlíková Přecechtělová, Bahmann, Kaupp, et Ernzerhof, JCP (2015)] et malgré les résultats supérieurs de CFX comparativement aux fonctionnelles courantes en DFT pour le calcul de l’énergie, cette approche n’est pas exacte pour les systèmes uniélectroniques. Les méthodes non locales telles que le facteur X [Antaya, Zhou, et Ernzerhof, PRA (2014)] corrigent ce problème. Ainsi, le but du projet du premier article est de combiner CFX avec le facteur X, afin de former un facteur XC exact pour l’atome d’hydrogène, tout en conservant les bonnes prédictions de CFX pour les molécules. Nos résultats montrent que notre modèle non local est exact pour les systèmes uniélectroniques, cependant, la densité électronique non locale a un comportement fortement oscillatoire qui rend difficile la construction du facteur XC et la qualité de ses prédictions pour les propriétés moléculaires est inférieure aux fonctionnelles hybrides. Notre étude permet de fournir une explication concernant l’échec des méthodes non locales en chimie, comme l’approximation de la densité pondérée [Gunnarsson, Jonson, et Lundqvist, PLA (1976)]. Les nombreuses oscillations de la densité non locale limitent la performance des facteurs XC qui sont trop simples et qui ne peuvent pas atténuer ces oscillations. vLe sujet du deuxième article de cette thèse [Cuierrier, Roy et Ernzerhof, JCP (2021)] est relié aux difficultés rencontrées durant le premier projet. L’apprentissage automatique (ML) est devenu une méthode populaire dans tous les domaines de la science. Les réseaux de neurones artificiels (NN) sont particulièrement puissants, puisqu’ils permettent un contrôle et une flexibilité considérables lors de la construction de fonctions approximatives. Ainsi, nous utilisons un NN pour modéliser le trou X à partir de contraintes physiques. Durant le premier projet de cette thèse, nous avons observé qu’une fonction mathématique simple n’est pas adaptée pour être combinée avec la densité non locale, les NN pourraient donc être un outil utile pour approximer un trou X. Néanmoins, ce chapitre s’intéresse à la densité locale, avant de s’attaquer à la non-localité. Les résultats que nous avons obtenus lors du calcul des énergies X des atomes montrent le potentiel des NN pour construire automatiquement des modèles du trou X. Une deuxième partie de l’article suggère qu’un NN permet d’ajouter d’autres contraintes à des approximations du trou X déjà existantes, ce qui serait utile pour améliorer CFX. Sans les NN, il est difficile de trouver une équation analytique pour accomplir cette tâche. L’utilisation du ML est encore récente en DFT, mais ce projet a contribué à montrer que les NN ont beaucoup d’avenir dans le domaine de la construction de trou XC. Finalement, le dernier chapitre concerne un projet [Cuierrier, Roy, Wang, et Ernzerhof, JCP (2022)] qui utilise aussi des NN en DFT. Des travaux précédents du groupe ont montré que le terme de quatrième ordre du développement en série de puissances de la distance interélectronique du trou X (Tσ (r)) [Wang, Zhou, et Ernzerhof, PRA (2017)] est un ingrédient utile pour améliorer les approximations du calcul de l’énergie X pour les molécules. Cependant, il n’a pas été possible de construire un modèle qui satisfait le deuxième et le quatrième terme du développement en série de puissances simultanément. Ainsi, avec l’expertise développée en apprentissage automatique lors du deuxième projet, le but de l’étude du troisième article est d’utiliser Tσ (r) comme une variable d’entrée à un NN qui approxime l’énergie X. Nous avons montré qu’en utilisant comme ingrédients la fonctionnelle de PBE, Tσ (r) et un NN, il est possible de s’approcher de la qualité des résultats d’une fonctionnelle hybride (PBEh) pour le calcul d’énergies d’atomisation, de barrières d’activation et de prédiction de la densité électronique. Cette étude démontre que Tσ (r) contient de l’information utile pour le développement de nouvelles fonctionnelles en DFT. Tσ (r) est en principe plus rapide à calculer que l’échange exact, donc nos fonctionnelles pourraient s’approcher de l’exactitude d’une fonctionnelle hybride, tout en étant plus rapides à calculer.

Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.

How this classification was reachedexpand

Full frame machine prediction

Teacher imitation

Not calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.

metaresearch head score (Codex)0.001
metaresearch head score (Gemma)0.003
Version: metacan-v3-hybrid-931329e0061cValidation status: machine_predicted_unvalidated
Candidate categoriesnone
Consensus categoriesnone
DomainCandidate signal: none · Consensus signal: none
Study designCandidate signal: Simulation or modeling · Consensus signal: none
GenreCandidate signal: Empirical · Consensus signal: none
Teacher disagreement score0.012
Threshold uncertainty score0.037

Distilled classifier scores by category (both heads)

CategoryCodexGemma
Metaresearch0.0010.003
Meta-epidemiology (narrow)0.0010.001
Meta-epidemiology (broad)0.0010.001
Bibliometrics0.0010.001
Science and technology studies0.0010.001
Scholarly communication0.0020.002
Open science0.0010.001
Research integrity0.0010.002
Insufficient payload (model declined to judge)0.0110.005

Machine scores (provisional)

The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.

Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.

Opus teacher head0.008
GPT teacher head0.206
Teacher spread0.198 · how far apart the two teachers sit on this one work
Validation statusscore_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from it

Classification

machine, unvalidated

Machine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.

The models applied no category: nothing in the taxonomy fit this work.
Study designSimulation or modeling
Domainnot available
GenreEmpirical

How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".

Quick stats

Citations0
Published2024
Admission routes1
Has abstractyes

Explore more

Same venuePapyrus : Institutional Repository (Université de Montréal)Same topicMachine Learning in Materials ScienceFrench-language works237,207