Prediction of maximum slug length considering impact of well trajectories in British Columbia shale gas fields using machine learning
Notice bibliographique
Résumé
In this study, the severity of slugging is assessed by predicting maximum slug lengths (MSL) quickly using the random forest (RF) algorithm based on the geometric features of well trajectories for a shale gas field. Severe slugging is one of the critical issues production engineering-wise because it causes operation shut-down. Thus it should be predicted for proactive measurements. A total of 5033 well trajectories were acquired from the northeastern area of British Columbia, Canada. The well trajectories are described using ten geometric features such as X, Y, and Z lengths in the Cartesian coordinate system, inclination, azimuth, and the other five. The 5033 well trajectories are grouped using the k-medoids clustering algorithm. The well trajectories in each group and the groups are compared visually to see if the ten features are representative enough to describe the geometric features of the well trajectories. The ten geometric features of the well trajectories are used as the input for RF, and MSL, which represents the severity of slugging, is used as the output for RF. The output data is simulation results by a pipe flow simulator, OLGA. The trained RF model provides the satisfactory prediction performance of MSL (R values, 0.866 and 0.857 for training and test data, respectively). In the trained RF model, X, Y, and Z lengths have the most significant importance among the ten geometric features. Because it is impractical to simulate all well trajectory scenarios by OLGA, the MSL values are projected onto a 3-dimensional map of which axes are X, Y, and Z lengths to visualize the trend of MSL. The 3-dimensional map showing the relation between MSL and the geometric features of well trajectories can be utilized as a quick reference to avoid severe slugging in designing well trajectories.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».