Predicting the Evolution of Influenza A
Notice bibliographique
Résumé
Vaccination against the Influenza A virus (IAV) is often an important and critical task for much of the population, as IAV causes yearly epidemics, and can cause even deadlier pandemics. Designing the vaccine requires an understanding of the current major circulating strains of Influenza, as well as an understanding of how those strains could change over time to become either less harmful or more deadly, or simply die out completely. An error in the prediction process can lead to a non-immunized population at risk of epidemics, or even a pandemic. Presented here is a posterior predictive approach to generate emerging influenza strains based on a realistic genomic model that incorporates natural features of viral evolution such as selection and recombination. Also introduced is a sequence sampling scheme to relieve the computational burden of the posterior predictive analysis by clustering sequences based on their pairwise similarity. Finally, the impact of “evolutionary accidents” that take the form of bursts of evolution and or of recombination on the predictive power of our procedure is tested. An analysis of the impact of these bursts is carried out in a retrospective study that focuses on the unexpected emergence of a new H3N2 strain in the 2007-08 influenza season. Measuring the R2 values of both pairwise and patristic distances, the model reaches a predictive power of ∼40%, but is not able to simulate the emergence of the target Brisbane/10/2007 sequence with a high probability. The inclusion of “evolutionary accidents” improved the algorithm’s ability to predict HA sequences, but the prediction power of the NA gene remained low.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,006 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,001 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,001 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».