Boosting biodiversity monitoring using smartphone-driven, rapidly accumulating community-sourced data
Notice bibliographique
Résumé
Abstract Ecosystem services, which derive in part from biological diversity, are a fundamental support for human society. However, human activities are causing harm to biodiversity, ultimately endangering these critical ecosystem services. Halting nature loss and mitigating these impacts necessitates comprehensive biodiversity distribution data, a requirement for implementing the Kunming-Montreal Global Biodiversity Framework. To efficiently collect species observations from the public, we launched the ‘Biome’ mobile application in Japan. By employing species identification algorithms and gamification elements, the app has gathered >6M observations since its launch in 2019. However, community-sourced data often exhibit spatial and taxonomic biases. Species distribution models (SDMs) enable infer species distribution while accommodating such bias. We investigated Biome data’s quality and how incorporating the data influences the performance of SDMs. Species identification accuracy exceeds 95% for birds, reptiles, mammals, and amphibians, but seed plants, molluscs, and fishes scored below 90%. The distributions of 132 terrestrial plants and animals across Japan were modeled, and their accuracy was improved by incorporating our data into traditional survey data. For endangered species, traditional survey data required >2,000 records to build accurate models (Boyce index ≥ 0.9), though only ca.300 records were required when the two data sources were blended. The unique data distributions may explain this improvement: Biome data covers urban-natural gradients uniformly, while traditional data is biased towards natural areas. Combining multiple data sources offers insights into species distributions across Japan, aiding protected area designation and ecosystem service assessment. Providing a platform to accumulate community-sourced distribution data and improving data processing protocol will contribute to not only conserving natural ecosystems but also detecting species distribution changes and testing ecological theories.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,004 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,002 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».