Automatic Fracture Identifications From Image Logs With Machine-Learning Approaches: A Contest Summary
Notice bibliographique
Résumé
Borehole image logs are essential for characterizing subsurface formations, particularly in identifying fractures that influence reservoir behavior and productivity. Manual interpretation of such logs, however, remains time consuming and susceptible to subjectivity and inconsistency. To address these challenges, the SPWLA Petrophysical Data-Driven Analytics special interest group (PDDA SIG) launched its 4th Annual Machine-Learning Competition, aimed at developing automated methods for accurate, efficient, and reproducible fracture detection. The competition utilized resistivity image logs and conventional quadruple-combo logs from eight wells in the Western Canadian Sedimentary Basin (WCSB), accompanied by expert-labeled fracture annotations for training. A separate blind test data set from two additional wells in the same basin was reserved for final evaluation. Participants were provided with a Jupyter Notebook containing preprocessed data and a baseline framework to facilitate model development. Submissions were evaluated based on F1 score and averaged root mean squared error (RMSE) on the blind test set, reflecting both classification accuracy and predictive reliability. This paper reviews the top five approaches submitted, highlighting key methodologies, feature engineering strategies, and model architectures that led to improved fracture detection performance. Our results demonstrate that advanced machine-learning techniques can substantially enhance the consistency and accuracy of fracture identification from borehole image logs. These findings support the integration of data-driven solutions into petrophysical workflows, offering scalable and objective tools to augment or replace manual interpretation, ultimately improving decision making in exploration and production operations.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,001 | 0,002 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».