Méthodes de recherche directe pour l'optimisation stochastique de boîtes noires
Bibliographic record
Abstract
La réalisation de cette thèse n'aurait pas été possible sans le concours de plusieurs personnes à qui je voudrais témoigner ma profonde gratitude.Je tiens d'abord à remercier les professeurs Sébastien Le Digabel et Michael Kokkolaras pour avoir accepté de m'encadrer tout au long de cette thèse.Qu'ils soient également remerciés pour leur gentillesse, leur disponibilité permanente, leurs connaissances et expériences personnelles qu'ils ont partagées avec moi, leur patience ainsi que leurs précieuses suggestions qui ont largement facilité l'aboutissement de cette longue aventure.Je voudrais particulièrement vous dire un grand merci pour votre confiance.Ce fut un immense plaisir de faire des recherches sous votre supervision.Je voudrais exprimer ma reconnaissance envers le professeur Charles Audet pour la qualité de ses cours qui ont su nourrir mes réflexions et qui m'ont donné des bases nécessaires pour la réalisation des différents projets de cette thèse.Je voudrais sincèrement le remercier pour sa patience et sa disponibilité à répondre à mes innombrables questions.Merci également pour ses suggestions pertinentes et sa précieuse collaboration, qui ont permis de mener à bien le premier projet de cette thèse.Merci également à Hydro-Québec, à Rio-Tinto, au FRQNT et au GERAD pour leur support financier tout au long de la thèse.Merci à Christophe et Viviane pour avoir toujours répondu à toutes mes questions.Merci à tous mes collègues et amis du GERAD, en particulier Dounia, Khalil, Ludovic, Pierre-Yves, Vilmar, Alexis, et surtout Mathieu Tanneau et Christian Bingane, à qui j'ai posé tellement de questions.Un grand merci à mes amis Kwassi Holali Degue, Josette Kuagbenu, Mawunyo K. Dagnon, Joseph Agbavor et surtout Francis Hounkpe pour les multiples discussions et collaborations.Je voudrais également que les professeurs Mylène Maïda et David Dereudre de l'université Lille 1 trouvent ici les sentiments de ma plus profonde gratitude pour leurs encouragements, leurs recommandations et pour m'avoir donné à travers leurs cours de solides bases en probabilité.Un spécial merci à Mme Maïda chez qui j'avais appris tellement de choses durant mon stage de Master 2.Je tiens spécialement à remercier le professeur Yaogan Mensah de l'université de Lomé, pour les solides bases acquises au travers de ses cours.Merci également pour ses recommandations et ses grands efforts avec les professeurs Midzodzi K. Pekpe et Djidula K. Motchon, grâce auxquels j'avais pu intégrer l'université Lille 1. Je tiens également à témoigner toute ma gratitude aux professeurs Edi K. Gagnassi pour ses nombreux soutiens, et Elias Apetogbo grâce à qui j'avais compris pour la toute première fois au Lycée ce que précision et rigueur voulaient dire en mathématiques.Merci à mes chers parents pour leur soutien inconditionnel et pour avoir cru en moi, et un spécial merci à Estelle et Aurore pour m'avoir épaulé chaque jour et poussé vers l'avant.v RÉSUMÉ L'optimisation informatique est omniprésente dans de nombreuses communautés et a suscité un intérêt sans précédent au cours des dernières décennies en raison de l'utilisation croissante des simulations informatiques pour la résolution de problèmes complexes survenant dans une multitude de domaines et plus particulièrement en ingénierie."L'optimisation de boîtes noires", thème majeur de cette thèse, n'émet aucune hypothèse sur l'existence de dérivées des fonctions ciblées et se concentre sur des problèmes où la fonction objectif ainsi que les contraintes sont données par une boîte noire dont les simulations informatiques constituent un exemple typique.Les valeurs exactes de ces fonctions déterministes au moyen desquelles sont modélisés les problèmes couramment rencontrés dans le domaine de l'apprentissage automatique, du traitement du signal, de la médecine ainsi que la biologie etc., ne sont en général pas toujours accessibles numériquement.En effet, elles ne peuvent parfois être obtenues que par le biais d'une boîte noire dont les évaluations sont corrompues par un bruit aléatoire, engendrant ainsi des problèmes d'optimisation stochastique de boîtes noires.Par ailleurs, même si la conception d'algorithmes performants d'optimisation stochastique a suscité un regain d'intérêt ces dernières années, il est à noter que la plupart des méthodes d'optimisation dites sans dérivée utilisent des approximations de gradient, se limitent à des problèmes sans contraintes ou sinon, supposent que ces dernières sont déterministes.Ainsi, les méthodes de recherche directe connues pour leur fiabilité et leur robustesse en pratique s'avèrent plus prometteuses pour les problèmes d'optimisation de boîtes noires.Cependant, force est de constater qu'assez rares sont les travaux portant sur la conception d'algorithmes de recherche directe pour l'optimisation stochastique de boîtes noires, dotés d'une preuve de convergence et surtout en présence de contraintes bruitées aléatoirement.Cette thèse se concentre alors sur la conception ainsi que l'analyse de convergence d'algorithmes de recherche directe pour l'optimisation stochastique de boîtes noires.Le premier projet de la présente thèse introduit une variante stochastique de l'algorithme de recherche directe par treillis adaptatif (MADS) initialement conçu pour l'optimisation de boîtes noires déterministes.La méthode proposée nommée StoMADS considère l'optimisation sans contrainte d'une fonction objectif dont les valeurs ne peuvent être obtenues que via une boîte noire corrompue par un bruit aléatoire de distribution inconnue.Étant donné que les valeurs déterministes exactes de ladite fonction sous-jacente ne sont pas accessibles numériquement, StoMADS fait usage de leurs estimés obtenus à partir d'observations aléatoires.En supposant ces estimés précis avec une probabilité suffisamment grande mais fixe, et de variance satisfaisant une certaine condition, un résultat de convergence de StoMADS a été obtenu grâce au calcul non lisse de Clarke et la théorie des martingales.Des études numériques comparant StoMADS à certains algorithmes disponibles dans le logiciel NOMAD d'op-vi timisation de boîtes noires, ont révélé la méthode proposée très prometteuse pour des applications concrètes.Le second projet généralise le cadre algorithmique de StoMADS en introduisant une large classe d'algorithmes de recherche directe dits de type directionnel, pour l'optimisation stochastique de boîtes noires (SDDS), et qui acceptent de nouveaux itérés en imposant une condition de décroissance suffisante à des estimés satisfaisant les mêmes hypothèses du premier projet.Sous une hypothèse supplémentaire de différentiabilité de la fonction objectif déterministe numériquement inaccessible, le taux de convergence de la méthode proposée a été étudié à l'aide des supermartingales.Quoique ne faisant usage d'aucune information de gradient contrairement à des méthodes existantes telles que la recherche linéaire stochastique ainsi que les algorithmes de région de confiance stochastiques, le taux de convergence de SDDS est similaire à celui des deux dernières méthodes et à celui de la large classe d'algorithmes de recherche directe déterministes de type directionnel qui acceptent également de nouveaux itérés en imposant une condition de décroissance suffisante.Le troisième projet de cette thèse introduit StoMADS-PB, un algorithme d'optimisation stochastique de boîtes noires sous contraintes.StoMADS-PB est une variante stochastique de l'algorithme MADS utilisant une approche de barrière progressive (PB) pour la gestion des contraintes, initialement conçu pour l'optimisation de boîtes noires déterministes sous contraintes générales.Similairement à Sto-MADS, les valeurs de la fonction objectif et des contraintes sont accessibles uniquement via une boîte noire bruitée aléatoirement.Ainsi, StoMADS-PB utilise également des estimés et par ailleurs, traite les contraintes en regroupant leurs violations en une seule fonction de violation de contrainte.Sous l'hypothèse que ces estimés sont précis et fiables avec des probabilités suffisamment grandes mais fixes, des résultats de convergence de la méthode vers des points stationnaires au sens de la dérivée généralisée de Clarke des fonctions objectif et de violation, ont été obtenus grâce à la théorie des martingales.Enfin, des expériences numériques menées sur 126 variantes stochastiques de 42 problèmes sous contraintes tirés de la littérature ont démontré l'efficacité de StoMADS-PB par rapport à MADS avec PB pour l'optimisation stochastique de boîtes noires.vii
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.005 | 0.012 |
| Meta-epidemiology (narrow) | 0.003 | 0.001 |
| Meta-epidemiology (broad) | 0.002 | 0.002 |
| Bibliometrics | 0.002 | 0.001 |
| Science and technology studies | 0.001 | 0.002 |
| Scholarly communication | 0.002 | 0.001 |
| Open science | 0.002 | 0.002 |
| Research integrity | 0.004 | 0.004 |
| Insufficient payload (model declined to judge) | 0.024 | 0.011 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".