MétaCan
Menu
Retour à la cohorte
Enregistrement W3094581867 · doi:10.1093/beheco/araa095

Comparing dominance hierarchy methods using a data-splitting approach with real-world data

2020· article· en· W3094581867 sur OpenAlexafffund
Chloé Vilette, Tyler R. Bonnell, S. Peter Henzi, Louise Barrett

Notice bibliographique

RevueBehavioral Ecology · 2020
Typearticle
Langueen
DomaineAgricultural and Biological Sciences
ThématiqueAnimal Behavior and Reproduction
Établissements canadiensUniversity of Lethbridge
Organismes subventionnairesNatural Sciences and Engineering Research Council of CanadaCanada Research Chairs
Mots-clésDominance hierarchyDominance (genetics)Reliability (semiconductor)HierarchyBiologyRanking (information retrieval)StatisticsRank (graph theory)CONTESTComputer scienceMachine learningMathematicsPsychologySocial psychologyAggression

Résumé

récupéré en direct d'OpenAlex

Abstract The development of numerical methods for inferring social ranks has resulted in an overwhelming array of options to choose from. Previous work has established the validity of these methods through the use of simulated datasets, by determining whether a given ranking method can accurately reproduce the dominance hierarchy known to exist in the data. Here, we offer a complementary approach that assesses the reliability of calculated dominance hierarchies by asking whether the calculated rank order produced by a given method accurately predicts the outcome of a subsequent contest between two opponents. Our method uses a data-splitting “training–testing” approach, and we demonstrate its application to real-world data from wild vervet monkeys (Chlorocebus pygerythrus) collected over 3 years. We assessed the reliability of seven methods plus six analytical variants. In our study system, all 13 methods tested performed well at predicting future aggressive outcomes, despite some differences in the inferred rank order produced. When we split the dataset with a 6-month training period and a variable testing dataset, all methods predicted aggressive outcomes correctly for the subsequent 10 months. Beyond this 10-month cut-off, the reliability of predictions decreased, reflecting shifts in the demographic composition of the group. We also demonstrate how a data-splitting approach provides researchers not only with a means of determining the most reliable method for their dataset but also allows them to assess how rank reliability changes among age–sex classes in a social group, and so tailor their choice of method to the specific attributes of their study system.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,274
Score d'incertitude au seuil0,384

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,001
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0010,001
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,446
Tête enseignante GPT0,419
Écart entre enseignants0,028 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations31
Publié2020
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueBehavioral EcologyMême sujetAnimal Behavior and ReproductionTravaux en français237 207