Référentiel des processus et d'un entrepôt générique des mesures pour la vérification & validation (V&V) des logiciels critiques
Bibliographic record
Abstract
Pour les secteurs tel que l'aviation, le médical, le nucléaire et l'aérospatial, la qualité du logiciel est un besoin capital. Le logiciel embarqué dans ces types des systèmes est reconnu comme étant critique car leurs échec peut causer blessures (ou mort) aux êtres humains ainsi que la perte d'investissements financiers considérables. \n \nDans cette thèse nous proposons un référentiel des processus de vérification et validation (V&V) et d'un entrepôt générique des mesures pour permettre, d'une part, de mieux définir et implémenter les objectifs, les processus, les activités, les tâches, les rôles, les produits de travail de la V&V dans les projets et, d'autre part, de faciliter la prise des décisions dans les projets de V&V par le biais d'un entrepôt des données des mesures pour mieux identifier, faire le suivi et l'évaluation des processus et produits (ex. des coûts, du temps, des ressources, etc.) des activités de V&V. \n \nLe référentiel sert à la définition des pratiques de V&V du développement du logiciel critique et en concordance avec les exigences de certification du guide DO-178B dans le contexte de l'aéronautique. Le contenu de ce référentiel de V&V est basé sur les pratiques du développement logiciel recommandées par les Processus Unifiés (PU). Nous avons utilisé la version « Open Source » des processus unifiés appelé « OpenUP » pour construire le référentiel. \n \nLe référentiel de pratiques de V&V est exprimé par le biais d'un artefact logiciel appelé «Plug-in» ou «plugiciel». Cet artefact a été construit avec l'outil « Eclipse Process Framewrok Composer (EPFC) », qui est une extension du « OpenUP ». EPFC est basé sur les principes de SPEM-OMG (Software Process Engineering Metamodel - Object Management Group). L'EPFC dorme la capacité au référentiel des pratiques de V&V de pouvoir être personnalisé ou adapté selon les particularités de chaque projet du logiciel critique. \n \nLa proposition des mesures pour les activités de V&V est fondée sur la proposition d'un entrepôt des mesures basé sur les principes décrits dans la norme ISO 15939 pour la construction des processus mesures dans le logiciel. \n \n \nL'entrepôt des mesures est basé également sur un modèle générique des mesures ainsi que sur la technologie OLAP (Online Analytical Processing) pour l'analyse multidimensionnelle des dormées des mesures. L'entrepôt des mesures proposé est basé sur un modèle générique qui ne présuppose pas un ensemble des mesures définies mais une structure basée sur un modèle orienté-objets qui permet de définir divers types de mesures basées sur les mêmes données stockées dans l'entrepôt. La technologie OLAP confère la flexibilité, la capacité de stoker, la capacité de représenter ainsi que la capacité d'analyser des mesures dans plusieurs perspectives. \n \nCette thèse, au cours de son élaboration, a bénéficié de la collaboration de différentes partenaires industriels tels que : NASA IV&V Facility, CMC Electronics, Verocel Inc. et Ericsson Research Canada.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame distilled prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. Learned from the 10,348 direct Codex labels and 10,348 direct Gemma labels. Candidate is the union of thresholded teacher heads; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels or direct frontier model labels.
Codex and Gemma teacher scores by category
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.009 |
| Meta-epidemiology (narrow) | 0.003 | 0.003 |
| Meta-epidemiology (broad) | 0.002 | 0.001 |
| Bibliometrics | 0.002 | 0.004 |
| Science and technology studies | 0.001 | 0.005 |
| Scholarly communication | 0.001 | 0.001 |
| Open science | 0.003 | 0.001 |
| Research integrity | 0.006 | 0.004 |
| Insufficient payload (model declined to judge) | 0.001 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; both teacher heads agree on what is shown here.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".