Canadian historical Snow Water Equivalent dataset (CanSWE, 1928-2024)
Notice bibliographique
Résumé
Description (in English, French follows) The Canadian historical Snow Water Equivalent dataset (CanSWE) includes manual and automated pan-Canadian observations of Snow Water Equivalent (SWE) collected by national, provincial and territorial agencies, hydropower companies and their partners, as well as academic institutions. Snow depth and derived bulk snow density are also included when available. A code describes the SWE measurement method for each site following World Meteorological Organization (WMO) standards (WMO, 2019). This new dataset supersedes the most recent update of the Canadian Historical Snow Survey (CHSSD) dataset published by Brown et al. (2019) and available at https://doi.org/10.18164/cf337b6b-9a87-4ffd-a8e5-41e6498b1474. The creation of CanSWE used the 2019 CHSSD update as a starting point and involved three main steps: (i) correction and cleaning of the 2019 CHSSD update (correction of metadata, removal of duplicates), (ii) update of this cleaned dataset until July 2020 and addition of snow data from new stations and agencies, and (iii) consistent quality control of the final dataset. The version 6 of CanSWE includes over one million SWE measurements from 2945 different locations across Canada over the snow seasons 1928 – 2024 where a snow season is defined as starting August 01 and ending July 31. CanSWE is described in detail in Vionnet et al. (2021). The data are distributed in 2 formats: a NetCDF file (CanSWE-CanEEN_1928-2024_v7.nc) and a zip file containing a csv version of CanSWE (CanSWE-CanEEN_1928-2024_v7.zip). More details about the dataset, the file format and the update made in CanSWEv7 are given in the files ReadMe_CanSWE_v7.pdf (in English) and LisezMoi_CanEEN_v7.pdf (in French). Description (Francais) La base données historiques canadiennes d’Equivalent en Eau de la Neige (CanEEN) comprend des observations manuelles et automatiques de l’Equivalent en Eau de la Neige (EEN) à l’échelle du Canada collectées par des agences nationales, provinciales et territoriales, des compagnies productrices d’hydroélectricité et leurs partenaires ainsi que par des universités. Les informations sur la hauteur de neige et la masse volumique moyenne du manteau neigeux sont incluses lorsqu’elles sont disponibles. Un code qui suit les règles de l’Organisation Mondiale de la Météorologie (OMM, 2019) décrit la méthode de mesure de l’EEN pour chaque site. Cette nouvelle base de données remplace le jeu de données des Relevés Nivométriques Canadiens (RNC) publié par Brown et al. (2019) et disponible à l’adresse : https://doi.org/10.18164/cf337b6b-9a87-4ffd-a8e5-41e6498b1474. La création de CanEEN se base sur la version de 2019 des RNC et se décompose en 3 étapes principales : (i) correction et nettoyage de la version 2019 des RNC (correction des métadonnées, suppression des duplicata), (ii) mise à jour de ce jeu de données nettoyé avec des données disponibles jusqu’en Juillet 2020 et ajout de données historiques provenant de nouvelles stations et de nouveaux partenaires, (iii) contrôle qualité appliqué à l’ensemble du jeu de données. La version 7 de CanEEN inclut plus d’un million de mesures de l’EEN collectées dans 2945 stations à travers le Canada pour les années nivologiques 1928 à 2023 où une année nivologique est définie pour la période allant du 1 août au 31 juillet. CanEEN est décrit en détail dans Vionnet et al. (2021). Les données sont distribuées sous deux formats: un fichier au format NetCDF (CanSWE-CanEEN_1928-2024_v7.nc) et une archive zip contenant un fichier au format csv (CanSWE-CanEEN_1928-2024_v7.csv). Des informations complémentaires sur le jeu de données, leur format ainsi que les modifications apportées dans la version 6 sont fournies dans les fichiers ReadMe_CanSWE_v7.pdf (en Anglais) et LisezMoi_CanEEN_v7.pdf (en Francais). References/Références: Brown, R. D., Fang, B., and Mudryk, L.: Update of Canadian historical snow survey data and analysis of snow water equivalent trends, 1967–2016. Atmos. Ocean, 57, 149 156, https://doi.org/10.1080/07055900.2019.1598843, 2019 Vionnet, V., Mortimer, C., Brady, M., Arnal, L., and Brown, R.: Canadian historical Snow Water Equivalent dataset (CanSWE, 1928–2020), Earth Syst. Sci. Data, 13, 4603–4619, https://doi.org/10.5194/essd-13-4603-2021, 2021. WMO (World Meteorological Organization): Global Cryosphere Watch: Improvements in the international reporting of Snow Depth, WIGOS Newsletter, 5, 3-4, https://community.wmo.int/wigos-newsletters-archive, 2019
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,004 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,004 | 0,010 |
| Études des sciences et des technologies | 0,002 | 0,000 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,002 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,025 | 0,018 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».