Caractérisation moléculaire et phylogénétique de l’enveloppe du VIH-1 transmis/fondateur
Notice bibliographique
Résumé
Vaincre efficacement l’infection par le VIH nécessite non seulement de raffiner davantage les traitements antirétroviraux, mais aussi de déployer des moyens de prévention à large échelle afin de stopper la propagation de la maladie. Il s’agit en effet de pouvoir développer un vaccin préventif ou thérapeutique à large spectre. L’atteindre de cet objectif requiert une meilleure compréhension des événements précoces médiés par les glycoprotéines d'enveloppe des virus transmis/fondateurs du VIH développés durant la primo-infection. Pendant que les efforts de la communauté scientifique se concentrent à trouver ce vaccin, il est également nécessaire de limiter le taux des nouvelles infections dans la population. Les résultats de nos travaux présentés dans cette thèse s’inscrivent dans cette optique de prévention des infections à VIH par l’étude de la dynamique de transmission de la maladie. Le premier volet de nos travaux dont les résultats sont consignés dans ce document et publiés dans le journal « PLOS ONE » (Chapitre III. Article 1) porte le titre : « Identification des nouvelles infections par le VIH-1 en utilisant des mesures de la diversité génétique des séquences de l’enveloppe ». L’objectif de cette étude était d’évaluer et de déterminer quelle méthode moléculaire parmi les mesures de diversité génétique de la séquence de l'enveloppe est capable de définir l’infection par le VIH-1 temporellement (récente versus chronique). Quatre mesures de diversité génétique des séquences virales de courts segments de l’enveloppe du VIH-1 ont été évaluées pour définir l’infection par le VIH-1 temporellement à savoir: le pourcentage de complexité, le pourcentage de diversité, le nombre d’haplotypes et l’entropie de Shannon. Nous avons identifié l'entropie de Shannon comme l'une des meilleures de ces quatre mesures de diversité qui associée à trois courts segments (≤100 paires de bases) de la séquence de l'enveloppe du VIH-1 est capable de prédire efficacement la période récente de l’infection par le VIH-1. L’indice de performance de l’entropie de Shannon (Aire sous la courbe (AUC) des trois segments de l’enveloppe du VIH-1 que sont : (1) région constante C2 segment 1 (C2_1), (2) région constante C2 segment 3 (C2_3) et (3) boucle V3 de la gp120 est respectivement de 0.806, 0.805 et 0.812. La capacité de différencier une infection récente d'une infection ancienne est importante en santé publique. En effet, les personnes nouvellement infectées sont les plus infectieuses et capables de propager rapidement la maladie dans la population. Puisque ces personnes ignorent leur statut sérologique, elles peuvent avoir plus de comportements à risque alors qu’elles ont une charge virale sanguine élevée d’un virus avec une capacité réplicative assez importante (fitness). Pouvoir identifier le plus tôt possible ces individus permettrait de limiter et de prévenir les nouvelles transmissions. Le deuxième volet de nos travaux consignés dans cette thèse (Chapitre III, Article 2) a été publié dans le journal « AIDS Research and Human Retroviruses » avec pour titre : « Analyses phylogénétiques des séquences du gène de l’enveloppe du VIH-1 pour l’évaluation et la construction à court terme des réseaux naissants de la transmission de l’infection par le VIH-1 ». Cette étude a consisté à identifier les liens phylogénétiques ou clusters qui existent entre les séquences virales de l’enveloppe du VIH-1 de patients nouvellement diagnostiqués au Québec. La formation de clusters entre les séquences virales de plusieurs individus pourrait refléter l'appartenance de ces personnes à un même réseau ou chaine de transmission. Ces personnes pourraient aussi partager des caractéristiques ou facteurs de risques communs au groupe. Les résultats de cette étude ont permis d’identifier 15 chaines ou réseaux de transmission mineurs (2-5 individus par réseau) de l’infection par le VIH-1 entre ces individus. Nous avons également évalué et comparé la capacité d’un fragment d’une séquence nucléotidique plus large de l’enveloppe du VIH-1 à celui de la boucle V3 beaucoup plus courte à pouvoir prédire et identifier de façon indépendante les individus qui pourraient être inclus dans un réseau ou grappe de transmission. Les résultats de nos analyses ont démontré une concordance modérée en se basant sur le coefficient kappa (k=0.59) entre les deux fragments de l'enveloppe virale utilisés. L’utilisation des séquences de la boucle V3 a en effet permis de confirmer 66.70% (10/15) des clusters identifiés avec un fragment plus long de la séquence de l’enveloppe du VIH-1. Le nombre de personnes infectées ayant accès aux tests de génotypage qui utilisent les séquences de la V3 pour déterminer le tropisme viral en pratique clinique courante est limité à l’échelle mondiale. Cependant, les séquences de l’enveloppe virale et particulièrement celles de la boucle V3 pourraient facilement être intégrées dans un programme de santé publique là où elles sont disponibles en complément de celles du gène pol (disponibles dans les laboratoires cliniques dans le cadre des tests de résistance aux traitements antirétroviraux) pour l’identification et la surveillance des réseaux de transmission du VIH-1 dans la population. Nous avons inclus les caractéristiques des sujets (données sociodémographiques, cliniques et facteurs de risque) dans un modèle d’analyse de régression logistique avec comme variable réponse (outcome) la formation de clusters de transmission. Les résultats de l'analyse démontrent que dans la population étudiée, l'âge moyen (<38.8 versus ≥38.8 ans) et le sous-type viral (sous type B versus non-B) sont deux facteurs significativement associés à la formation des clusters ou réseaux. L’identification des chaines de transmission du VIH-1 dans un échantillon de la population infectée par le VIH-1 au Québec et les facteurs de risques communs à ces personnes devraient permettre de mieux implanter les stratégies de prévention dans les groupes cibles. Les résultats de la troisième et dernière partie de nos travaux présentée dans cette thèse (Chapitre III, Article 3) ont été publiés dans le Journal « VIRUSES » sous le titre : « Identification de signatures génétiques au niveau de la glycoprotéine de l’enveloppe du VIH-1 associées aux virus transmis/fondateurs et récents de sous-types B ». Cette étude a consisté à identifier des signatures génétiques au niveau des séquences virales de l’enveloppe des premiers variants du VIH-1 appelés virus transmis/fondateurs ou « Transmitted/Founder viruses ». Ces variants constituent ceux qui sont capables d’établir une infection productive au moment de l'infection. Ils sont en effet sélectionnés parmi une multitude de quasi-espèces virales exposées au cours de la transmission du virus. Ils détiennent ainsi toutes les propriétés phénotypiques et ou fonctionnelles nécessaires à l’établissement de l’infection. L’identification de signatures génétiques observées précocement au niveau de la glycoprotéine de l’enveloppe du VIH-1 au cours de l’infection pourrait informer la conception de nouveaux inhibiteurs d’entrée immunologiques ou chimiques, mais aussi servir de repère pour le design d’un vaccin anti-VIH-1. Nos travaux ont permis d’identifier quelques signatures génétiques, mais une consistant en une mutation/substitution de l'Arginine (R) par une Isoleucine (I) associée au virus TF semble être particulièrement prononcée. Cette mutation est localisée à la position 841 (R841I) spécifiquement dans le domaine cytoplasmique de la GP41 notamment dans le segment 1 des peptides lytiques de lentivirus (LLP-1). L’isoleucine est sélectionnée (I) à plus de 33% par les virus TF comparativement aux virus d’infections chroniques (9%) et la différence est statistiquement significative, OR=0.2, 95% IC [0.09, 0.44], P= 0.00001. Le domaine cytoplasmique de la GP41 et spécifiquement le LLP-1 est fortement impliqué dans la réplication virale en intervenant dans le trafic intracellulaire et l’incorporation des glycoprotéines de l'enveloppe dans les virions. Une mutation dans ce domaine pourrait être un mécanisme moléculaire (polymorphisme) nécessaire à l’établissement de la transmission et d’échappement à la réponse immunitaire.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,001 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».