MétaCan
Menu
← Back to cohort
Record W7133280291

Examen préliminaire de l'efficacité de plusieurs algorithmes de détection acoustique automatique des vocalises de baleine noire de l'Atlantique Nord, et recommandations par rapport aux prochaines étapes relatives à l'évaluation et à l'optimisation de ces algorithmes

2023· other· fr· W7133280291 on OpenAlexaboutno aff
Jack W. Lawson

Bibliographic record

VenueFederal Open Science Repository of Canada / Le Dépôt fédéral de science ouverte du Canada · 2023
Typeother
Languagefr
Field
Topic
Canadian institutionsnot available
Fundersnot available
KeywordsClassification schemeStatistical analysisStructured-light 3D scanner
DOInot available

Abstract

fetched live from OpenAlex

La détection et la classification automatisées des vocalises de baleine noire de l’Atlantique Nord et d’autres mammifères marins sont hautement souhaitables pour les chercheurs et les gestionnaires qui cherchent à surveiller leur présence dans certaines zones afin de mettre en œuvre des mesures d’atténuation. Ce type de traitement acoustique automatisé est particulièrement important pour les approches de surveillance en temps réel qui traitent de grandes quantités de données acoustiques. Tous les systèmes de détection et de classification (SDC) utilisés par Pêches et Océans Canada (MPO) doivent offrir des résultats similaires, compte tenu des données (p. ex., heures avec vocalise/jour) utilisées pour présenter les occurrences de baleine noire de l’Atlantique Nord dans le temps, ce qui a déjà été démontré en comparant l’efficacité de divers détecteurs lors d’études menées en 2004, 2013 et 2017. Le Spectroplotter (un programme commercial) et le système de détection et de classification des basses fréquences (LFDCS, pour Low Frequency Detection and Classification System), deux systèmes ayant été utilisés pour analyser les données acoustiques dans la région de Terre-Neuve-et-Labrador et la région des Maritimes, donnent de bons résultats, bien que dans une petite étude, le LFDCS ait détecté plus de véritables vocalises de contact à modulation ascendante de baleine noire de l’Atlantique Nord que le Spectroplotter, mais ait également généré plus de faux positifs. L’efficacité d’un SDC est influencée par de multiples facteurs, y compris les niveaux de bruit ambiant par rapport aux caractéristiques de la vocalise de contact à modulation ascendante de la baleine noire de l’Atlantique Nord, l’emplacement de l’hydrophone, les caractéristiques du système d’enregistrement, les réglages et les seuils du logiciel, et d’autres caractéristiques contextuelles, comme la présence d’autres espèces. La prochaine génération de SDC intégrera le contexte dans sa logique (p. ex., la présence d’autres mammifères marins ou de sources sonores abiotiques et le rapport signal sur bruit). Les comparaisons d’algorithmes sont moins importantes dans les analyses historiques de la baleine noire de l’Atlantique Nord puisque les données qui découlent des résultats de détection actuels sont présentées à une échelle suffisamment grande (« Une baleine noire de l’Atlantique Nord a-t-elle été détectée à proximité de cet enregistreur aujourd’hui »?) pour que les légères différences en matière d’efficacité des algorithmes ne soient pas perceptibles après le processus d’amalgamation et de cumul. À des échelles d’échantillonnage spatiales et temporelles plus petites, les différences en matière d’efficacité des algorithmes deviennent plus visibles. Un test complet des différents SDC utilisés au Canada atlantique nécessiterait une série d’ensembles de données acoustiques validées manuellement et provenant d’un ensemble représentatif de lieux, de périodes, de saisons et de matériel d’enregistrement. Comparer ainsi les SDC serait une activité utile, mais nécessiterait que des mesures et des seuils de rendement soient établis pour ceux-ci.

Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.

How this classification was reachedexpand

Full frame machine prediction

Teacher imitation

Not calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.

metaresearch head score (Codex)0.005
metaresearch head score (Gemma)0.012
Version: metacan-v3-hybrid-931329e0061cValidation status: machine_predicted_unvalidated
Candidate categoriesnone
Consensus categoriesnone
DomainCandidate signal: none · Consensus signal: none
Study designCandidate signal: Not applicable · Consensus signal: none
GenreCandidate signal: Methods · Consensus signal: Methods
Teacher disagreement score0.942
Threshold uncertainty score0.115

Distilled classifier scores by category (both heads)

CategoryCodexGemma
Metaresearch0.0050.012
Meta-epidemiology (narrow)0.0020.001
Meta-epidemiology (broad)0.0010.001
Bibliometrics0.0020.001
Science and technology studies0.0010.001
Scholarly communication0.0030.002
Open science0.0010.001
Research integrity0.0020.001
Insufficient payload (model declined to judge)0.0040.003

Machine scores (provisional)

The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.

Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.

Opus teacher head0.021
GPT teacher head0.286
Teacher spread0.264 · how far apart the two teachers sit on this one work
Validation statusscore_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from it

Classification

machine, unvalidated

Machine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.

The models applied no category: nothing in the taxonomy fit this work.
Study designNot applicable
Domainnot available
GenreMethods

How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".

Quick stats

Citations0
Published2023
Admission routes1
Has abstractyes

Explore more

Same venueFederal Open Science Repository of Canada / Le Dépôt fédéral de science ouverte du Canada→French-language works237,207→