FLOCK: a method for quick mapping of admixture without source samples
Notice bibliographique
Résumé
Identifying and estimating individual and/or population admixture is a very common objective in evolution and conservation biology. There are many situations where samples from one or many of the putatively hybridizing entities are not available or easily identified. Here we describe FLOCK, a new method especially designed to provide spatial and/or temporal admixture maps in the absence of one or several source samples. FLOCK is a non-Bayesian method and therefore differs substantially from previous clustering algorithms. Its working principle is repeated re-allocation of all collected specimens (total sample) to the k subsamples, each re-allocation being more effective than the previous one in attracting genetically similar individuals. This snowball effect, more formally referred to as a positive feedback mechanism, makes FLOCK an efficient and quick sorting process. The usage of FLOCK is illustrated with two empirical situations which have been thoroughly analysed previously with other approaches. A number of simulations were run to better assess the power of the FLOCK algorithm. Performance comparisons were made between the FLOCK and Structure algorithms. When non-negligible numbers of pure genotypes were present, the two performed equally well. However, FLOCK proved significantly more powerful in the absence of pure genotypes. Moreover, FLOCK showed more potential for fast processing. Run times were shown to increase linearly with size of total sample and with size of k, the number of reference samples from which admixture mapping is performed.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».