Prise de décision liée à la conception et aux opérations en milieu industriel complexe par l'étude des données en temps réel
Notice bibliographique
Résumé
RÉSUMÉ: Aujourd'hui, dans les industries de transformation, de nombreuses données sont mesurées par des capteurs en temps réel, stockées selon un protocole, puis interprétées pour la prise de décision. Ces données contiennent plusieurs sources et types d'erreurs et, par conséquent, des techniques de traitement des données doivent être appliquées avant d'incorporer ces données dans toute analyse. De plus, l'interprétation des données n'est pas évidente, car les données représentent des opérations complexes. La mise en oeuvre d'approches de traitement des données (ou des signaux) permet de corriger les erreurs de mesure afin d'améliorer la fidélité des données et de disposer d'une base plus fiable pour la prise de décision concernant les procédés. Dans la pratique, la plupart des décisions liées au procédé sont prises en tenant compte de l'état d'équilibre du procédé, mais très peu considèrent qu'un procédé opère sous plusieurs régimes permanents distincts. Une revue de la littérature sur les techniques de traitement des signaux utilisées dans le contexte des opérations en régime permanent a révélé que différentes applications de prise de décision nécessitent des étapes de traitement des signaux distinctes, ces dernières pouvant inclure par exemple le nettoyage des données, la détection des régimes permanents, la réconciliation des données et la détection des régimes d’opération. Pour mieux comprendre les pratiques industrielles liées aux données de procédé, des entrevues sont menées avec des répondants de l'industrie afin d'explorer comment les données peuvent être utilisées et traitées dans différents contextes de prise de décision, quelle est la valeur ajoutée des données de procédé, et les principaux obstacles qui empêchent les usines de les utiliser à leur plein potentiel. Ces entrevues sont menées avec (1) des expertes et experts en usine ainsi que (2) des développeuses et développeurs de logiciels travaillant en soutien à l'industrie des pâtes et papiers. Les entrevues ont révélé que le nettoyage des données est effectué en relation avec l'application. Les expertes et experts de procédé sont minutieux en ce qui concerne cette étape, mais des approches rudimentaires sont encore utilisées par rapport à ce qui est possible et facilement disponible. De plus, les entrevues ont confirmé que la plupart des décisions dans l'industrie sont basées sur un paradigme d'état d’équilibre. Par exemple, les personnes en industrie font généralement la moyenne des données de procédé représentant des opérations "bonnes et normales" pour la majorité de leurs analyses. La littérature propose de nombreuses techniques basées sur les statistiques pour détecter les périodes en régime permanent au sein d’un procédé, mais celles-ci ne sont généralement pas utilisées par les expertes et experts de l'usine. En outre, les entrevues ont mis en évidence que les données de procédé auraient une plus grande valeur si les régimes d’opération étaient pris en compte. ABSTRACT: Today in the process industries, extensive data are measured by sensors in real-time, stored according to a protocol, and then interpreted for decision-making. These data contain several sources and types of error and, therefore, data processing techniques must be applied before incorporating these data into any analysis. Furthermore, data interpretation is not obvious because the data represent complex operations. The implementation of data (or signal) processing approaches enables the correction of measurement errors to improve data fidelity, and a more reliable basis for process decision-making. In practice, most process decisions are made considering process steady-state, but very few consider that a process operates under many distinct steady-state regimes. A literature review of signal processing techniques employed for the context of steady-state operations revealed that different decision-making applications require distinct signal processing steps, the latter of which can include for example data cleaning, steady-state detection, data reconciliation, and operating regime detection. To better grasp industrial practice related to process data, interviews are completed with industry respondents to explore how data might be used and processed in different decision-making contexts, what the added value of process data is, and the major barriers that prevent plants from using them to their full potential. These interviews are conducted with (1) mill experts as well as (2) with software developers working in support of the pulp and paper industry. The interviews revealed that data cleaning is performed in relation to the application. Process experts are thorough regarding this step, but rudimentary approaches are still used compared to what is possible and readily available. Moreover, the interviews confirmed that most decisions in industry are based on a steady-state paradigm. For example, industry practitioners generally average process data representing “good and normal” operations for the majority of their analyses. The literature proposes numerous statistically-based techniques to detect steady state periods in a process, but these are generally not used by plant experts. Furthermore, the interviews highlighted that process data would have greater value if operating regimes were considered.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,017 | 0,046 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,004 | 0,004 |
| Études des sciences et des technologies | 0,002 | 0,003 |
| Communication savante | 0,012 | 0,008 |
| Science ouverte | 0,002 | 0,003 |
| Intégrité de la recherche | 0,003 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,010 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».