Études de nouvelles maladies neurogénétiques chez les Canadiens français
Notice bibliographique
Résumé
Depuis déjà plusieurs décennies, nous sommes en mesure d'identifier les mutations responsable de diverses maladies mendéliennes. La découverte des gènes responsables de ces maladies permet non seulement un meilleur diagnostic clinique pour ces familles, mais aussi de mieux comprendre les mécanismes physiopathologiques de ces maladies ainsi que mieux définir la fonction normale des gènes causales. Ultimement, ces découvertes mènent à l'identification de cibles thérapeutiques pour le traitement de ces maladies. Les progrès technologiques sont depuis toujours un facteur très important dans la découverte de ces gènes mutés. De l'approche traditionnelle de clonage positionnel en passant par la première séquence du génome humain et maintenant les technologies de séquençage à grande échelle, de plus en plus de maladies ont maintenant une entité génétique. Dans le cadre de ce projet de doctorat, nous avons utilisé tant les approches traditionnelles (leucodystrophies) que les nouvelles technologies de séquençage (polyneuropathie douloureuse) qui ont mené à l'identification du gène causal pour plusieurs de nos familles. L'efficacité de ces deux approches n'est plus à démontrer, chacune d'entre elles possèdent des avantages et des inconvénients. Dans le cadre de ces projets, nous avons utilisé la population canadienne-française connue pour ces effets fondateurs et la présence, encore aujourd'hui, de grandes familles. Les différents projets ont permis d'établir certains avantages et inconvénients quant à l'utilisation de ces techniques et de la population canadienne-française. Dans le cadre d'un phénotype assez homogène et bien défini comme celui du projet leucodystrophie, l'approche traditionnel par gène candidat nous a permis d'identifier le gène causal, POLR3B, sans trop de difficulté. Par contre, pour les autres projets où nous sommes en présence d'une hétérogénéité clinique et génétique une approche non-biaisée utilisant le séquençage exomique a obtenu un plus grand succès. La présence de grandes familles est un grand avantage dans les deux approches. Dans le projet polyneuropathie douloureuse, une grande famille originaire du Saguenay-Lac-St-Jean nous a permis d'identifier le gène NAGLU comme responsable suite à l'exclusion des autres variants candidats par analyse de ségrégation. Comme NAGLU était déjà associé à un phénotype qui diffère sur plusieurs points à celui de notre famille, une approche traditionnelle n'aurait pas été en mesure d'identifier NAGLU comme le gène causal. Dans l'analyse de nos données de séquençage exomique, nous avons observé que plusieurs variants rares, absents des bases de données, étaient partagés entre les différents individus Canadiens français. Ceci est probablement dû à la démographie génétique particulière observée chez les Canadiens français. En conclusion, les technologies de séquençage à grande échelle sont avantageuses dans l'étude de maladies hétérogènes au niveau clinique et génétique. Ces technologies sont en voie de modifier l'approche d'identification de gènes en permettant une analyse de génétique inversée, c'est-à-dire de la génétique vers la clinique.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,007 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,004 | 0,007 |
| Études des sciences et des technologies | 0,002 | 0,001 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,007 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».