MétaCan
Menu
Retour à la cohorte
Enregistrement W4393712493 · doi:10.5281/zenodo.4272063

Labels for Emergency Response Imagery from Hurricane Barry, Delta, Dorian, Florence, Ida, Isaias, Laura, Michael, Sally, Zeta, and Tropical Storm Gordon

2022· dataset· en· W4393712493 sur OpenAlexaff
Evan B. Goldstein, Daniel Buscombe, Eli D. Lazarus, Katherine Anarde, Andrew D. Ashton, Tomas Beuzen, Katherine A. Castagno, Nicholas Cohn, Matthew P. Conlin, Isamar Cortés, Andrew S. Davey, Ashley Ellenson, Megan N. Gillen, Paige A. Hovenga, Ryan Mieras, Somya D. Mohanty, Michael Mungaray, Jin‐Si R. Over, Rose V. Palermo, Katherine Ratliff, Ian Reeves, Lily H. Sanborn, Rajesh Sigdel, William Speiser, Jacob Stasiewicz, Jessamin A. Straub, Steven Tagner, Luke Taylor, Elizabeth Wallace, Phillipe A. Wernette, Hannah Williams

Notice bibliographique

RevueZenodo (CERN European Organization for Nuclear Research) · 2022
Typedataset
Langueen
DomaineEarth and Planetary Sciences
ThématiqueTropical and Extratropical Cyclones Research
Établissements canadiensUniversity of British Columbia
Organismes subventionnairesnon disponible
Mots-clésTropical cycloneStormHistoryMeteorologyGeography

Résumé

récupéré en direct d'OpenAlex

The csv files contain human-generated labels for Emergency Response Imagery collected by US National Oceanic and Atmospheric Administration (NOAA) after Hurricane Barry, Delta, Dorian, Florence, Ida, Isaias, Laura, Michael, Sally, Zeta, and Tropical Storm Gordon. All authors contributed to labeling the imagery. All labeling was done with an open-source labeling tool (Rafique et al., 2020). All csv files provide the userID (the ID of the anonymous labeler), the NOAA flight, the NOAA image, and 6 labels — allWater (if the image was all water), devType (if the image had buildings/development), washoverType (if the image had washover deposits), dmgType (if the image showed damage to built environment), impactType (if the labeler could identify the coastal impact, using the Storm Impact Scale from Sallenger, 2000), and terrainType (the type of physical environment). Images labeled here correspond to multiple NOAA flights — all listed in the csv file for each jpeg image. These jpeg images can be downloaded directly from NOAA (https://storms.ngs.noaa.gov/) or using Moretz et al. (2020a, 2020b). There are three csv files: ReleaseData_10172022.csv has 10,237 labels for 4250 images. These labels were generated by coastal scientists. The csv also contains the Latitude and Longitude of the image center (from NOAA). ReleaseDataQuads.csv has 400 labels for 100 images. These labels were generated by coastal scientists. The images labeled in this set correspond to original NOAA images that have been split into quadrants. Splitting images was done with ImageMagick. The command used to split the images was: `magick mogrify -crop 2x2@ +repage -path ../quadrants *.jpg` The naming convention corresponds to the image quarter — the *-0.jpg is upper left, *-1.jpg is upper right, *-2.jpg is lower left, and *-3.jpg is the lower right. ReleaseDataNCE.csv has 400 labels for 100 images. These images were labeled by non-coastal scientists. Note that the 100 images were also labeled by coastal scientists — those labels can be found in ReleaseData_v3.csv. There is another companion dataset to this, with slightly different labels (Goldstein et al., 2020). A zip file of images is also provided for demonstration purposes (images.zip). These are resized copies made with imagemagick, with the longest dimension set at 2000 pixels ( `mogrify -resize 2000x2000`). For full size images, please download the jpegs directly from NOAA.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,001
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMéta-épidémiologie (sens strict), Études des sciences et des technologies, Charge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesCharge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Sans objet · Signal consensuel: Sans objet
GenreSignal candidat: Jeu de données · Signal consensuel: Jeu de données
Score de désaccord entre enseignants0,398
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,001
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0010,000
Bibliométrie0,0000,001
Études des sciences et des technologies0,0030,000
Communication savante0,0010,000
Science ouverte0,0020,001
Intégrité de la recherche0,0000,001
Charge utile insuffisante (le modèle a refusé de juger)0,4010,003

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,025
Tête enseignante GPT0,240
Écart entre enseignants0,216 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeSans objet
Domainenon disponible
GenreJeu de données

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2022
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueZenodo (CERN European Organization for Nuclear Research)Même sujetTropical and Extratropical Cyclones ResearchTravaux en français237 207