Time-Series Data Augmentation Techniques for Improving Automated Drilling Dysfunction Classifiers
Notice bibliographique
Résumé
Abstract Detecting drilling dysfunctions from surface data is not always easy as downhole vibrations tend to get damped before they reach surface sensors. Building machine learning models to recognize patterns in the surface data requires vibration signals captured by downhole sensors for training purposes. Such datasets are not widely available and therefore a methodology to expand these datasets is highly desirable. This work explores ways to utilize data augmentation to artificially diversify and increase datasets to build better models. Stick-slip (including full-stick), bit bounce, whirl, and bit balling are the primary dysfunctions considered in this work. Bayesian networks are used as classifiers to keep the model intuitive, and address situations where some input data is missing or unavailable. Once the dysfunction events in the downhole dataset were labeled, data augmentation techniques were used to generate synthetic data for scenarios where data was sparse. The dataset used in the project consisted of nine wells (with 19 bit runs). Most of the bit runs had a downhole vibration sensor at the bit, while some had sensors along the string as well. Of these 19 bit runs, 15 were used for training and four were used to test the models. Various data augmentations techniques were applied, and validated manually as appropriate synthetic data. In the case of full-stick event detection, the saw tooth pattern in the surface torque signal was captured and provided as an input to the classifier. The classifiers thus trained were able to detect the dysfunctions using data from surface sensors to a high level of accuracy and with low false alarm rates. This paper presents models to predict downhole dysfunctions from surface data alone. This paper also provides guidance on data augmentation techniques that use sparse downhole datasets to improve machine learning drilling advisory models. For identifying drilling dysfunction from surface data, the tortuosity of the well is also taken into account.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,001 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».