A Worldwide Historical Dam Failure's Database / Base de données de ruptures historiques de barrages à travers le monde
Notice bibliographique
Résumé
This database compiles a total of 3,860 cases of dam failure worldwide, regardless of the type of dams (man-made dam, retention dam, temporary dam, natural dam, etc.), either the type of structure (concrete dam, embankment dam, etc.), the type of failure (failure due to internal erosion, overtopping failure, etc.) or the properties of the dams (dam height, reservoir capacity, etc.). Overall, the dataset compiled for each case of rupture aims to standardize data collection for the different types of dams identified and to facilitate the international collection by setting guidelines. Notice that in this first version, 40 variables have been used. The record failure description obtained through this investigation work might be a door opening in various fields of research, such as hydrology, hydraulics, and dam safety. In regard to the magnitude of the task, it is possible that duplicates and/or missing data still remain. The author encourages readers to share their suggestions, remarks and/or questions to the author. If inconsistencies and/or more failures are observed by the user, a list can be sent via email in order to transmit observations / corrections / uncertainties / questions. An updated version will be deposited at undetermined frequencies. Its general structure can easily be adapted to the needs of the user and will, however, be updated over the years. Cette base de données compile un total de 3 860 cas de rupture de barrages à travers le monde, indépendamment du domaine d’application (barrage construit par l’homme, barrage de rétention, barrage temporaire, barrage naturel, etc.), du type d’ouvrage (barrage en béton, barrage en remblai, etc.), du mode de rupture (rupture par érosion interne, rupture par submersion, etc.) et des propriétés des ouvrages (hauteur du barrage, capacité du réservoir, etc.). Globalement, le jeu de données traduisant un total de 46 variables vise à uniformiser la collecte de données pour les différents types de barrages recensés et à faciliter la collecte à l’internationale à l’aide de balises. La structure proposée permet d’ouvrir la porte à de nouvelles études, et ce, dans divers domaines de recherche, tels que l’hydrologie, l’hydraulique et la sécurité des barrages. Comme il s’agit de la première version, il est possible que des doublons et/ou que de nouveaux cas de rupture soient mis en évidence. Si des incohérences ou nouvelles données sont remarquées par l’utilisateur, il est invité à transmettre ses observations/corrections/incertitudes à l’auteure (via courriel). De plus, bien que sa structure puisse aisément être adaptée en fonction des besoins de l’utilisateur (via the open XLSX file), celle-ci sera également mise à jour au fil des années. Notez que des mises à jour seront déposés à des fréquences indéterminées pour assurer le suivi des enregistrements.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,013 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,012 | 0,012 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,003 | 0,003 |
| Science ouverte | 0,002 | 0,002 |
| Intégrité de la recherche | 0,002 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,033 | 0,029 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».