A Benchmark of methods for SARS-CoV-2 whole genome sequencing and development of a more sensitive method
Notice bibliographique
Résumé
The raging COVID-19 pandemic caused by SARS-CoV-2 has so far claimed the lives of 7 million people and continues to infect many more. Further, virus evolution has caused mutations that have compromised public health interventions like vaccination regimes and monoclonal antibody and convalescent sera treatments. In response, unprecedented large-scale whole genome viral surveillance approaches have been devised to keep track of the evolution and transmission patterns of the virus within and across populations. Here, we aimed to compare efficiencies of SARS-CoV-2 whole genome sequencing approaches using synthetic SARS-CoV-2 genome and six cell culture SARS-CoV-2 variants titrated to represent samples at high, medium, and low viral load. We found that the ARTIC protocols performed best in terms of PCR amplicon yield returning 67% more amplicons than Entebbe protocol which was the second highest PCR amplicon yielding protocol. ARTIC v4.1 protocol yields were only slightly better than ARTIC v3. Despite yielding the lowest PCR amplicons, the SNAP protocol showed the highest genome completeness using a synthetic genome at high viral titre followed by ARTIC protocols. However, the ARTIC protocols showed highest genome completeness with cell culture SARS-CoV-2 variants across high, medium and low viral titres. ARTIC protocol also performed best in calling the correct lineage among cell culture SARS-CoV-2 variants across different viral titres. We also designed a new method termed ARTIC-Amp which leverages ARTIC protocol and performs a rolling circle amplification to increase yield of amplicons. In a proof-of-principle experiment, this method showed 100% coverage in all four targeted genes across three replicates unlike the ARTIC protocol missed one gene in two of the three replicates. Our results demonstrate the robustness of the ARTIC protocol and propose an improved method that could be useful for samples that routinely have limited SARS-CoV-2 RNA such as wastewater samples.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,016 | 0,022 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,001 |
| Méta-épidémiologie (sens large) | 0,002 | 0,002 |
| Bibliométrie | 0,003 | 0,002 |
| Études des sciences et des technologies | 0,001 | 0,002 |
| Communication savante | 0,003 | 0,002 |
| Science ouverte | 0,002 | 0,003 |
| Intégrité de la recherche | 0,004 | 0,004 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,004 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».