GWAD: Greedy Workflow Graph Anomaly Detection Framework for System Traces
Notice bibliographique
Résumé
System traces are a collection of time-stamped messages recorded by the operating system while the system is running. Analysis of these traces is crucial for tasks such as system fault finding. Moreover, detecting anomalies in system behavior becomes crucial in safety-critical and time-sensitive systems where delayed detections can lead to catastrophic outcomes. Therefore, we focus on developing a lightweight and explainable approach for safety-critical time-sensitive systems.Given a set of system traces under normal conditions and anomalous conditions, trace-based anomaly detection aims at classifying the trace as anomalous or not. In this work, we introduce GWAD, a greedy workflow graph framework for anomaly detection, a novel greedy graph construction approach for both offline and online anomaly detection in system traces. Our approach utilizes both sequence of occurrence of events and the time interval between their occurrences in learning the normal system behavior. We propose two approaches, first for offline classification of the trace as anomalous or normal using the event occurrence workflow graphs and secondly an online streaming algorithm that monitors the events as they occur in real-time for detecting anomalies increasing system resilience. Our approach also provides reasoning for the cause of anomalous behavior. We show that GWAD is better than traditional state-of-the-art models. The paper shows the technical feasibility and viability of GWAD through multiple case studies using traces from a field-tested hexacopter.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,001 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».