Études d’association pangénomique pour l’identification des régions génomiques influençant la qualité nutritionnelle chez le soya canadien
Notice bibliographique
Résumé
Le soya est une source importante de protéines, d'huile, de glucides, ainsi que d'autres nutriments bénéfiques, tels que des éléments minéraux. Une fonction majeure des protéines dans la nutrition est de fournir des quantités adéquates d'acides aminés. Bien qu’ils soient essentiels pour la santé humaine et la nutrition animale, les acides aminés soufrés que sont la cystéine (Cys) et la méthionine (Met) sont souvent en concentration limitée et le déterminisme génétique de leur teneur dans la graine de soya est mal caractérisé. Un autre facteur non moins important pour la qualité nutritionnelle du soya est sa teneur en éléments minéraux, laquelle affecte les caractéristiques d'utilisation finale des fractions d'huile et de protéines ainsi que la qualité des semences (germination, vigueur des jeunes plantules). Malheureusement, très peu d’attention a été portée sur les variétés canadiennes de soya en ce qui a trait à leur teneur en acides aminés soufrés ainsi qu’en éléments minéraux. L’amélioration génétique est l’une des voies les plus efficientes et économiques pour contribuer à une alimentation saine et nutritive, laquelle apporte au consommateur la quantité de nutriments nécessaires à une bonne santé. Pour que puisse se pratiquer une sélection en faveur d’une qualité nutritionnelle accrue, il faut idéalement identifier les déterminants génétiques de la teneur en divers nutriments et développer des marqueurs facilitant cette sélection. Présentement, les analyses d’association pangénomique (GWAS en anglais) constituent l’approche la plus puissante pour déterminer l’assise génétique d’un caractère. Dans les cas les plus favorables, non seulement ces analyses permettent-elles d’identifier des régions génomiques qui contrôlent en tout ou en partie les caractères étudiés, mais elles peuvent même permettre d’identifier des gènes candidats qui jouent un rôle direct dans ce déterminisme. Dans le cadre de cette thèse, nous avons souhaité déterminer l’assise génétique de composantes clés de la valeur nutritive du soya, soit la teneur en acides aminés soufrés (Cys/Met) et en quatre éléments minéraux majeurs (Ca, K, P et S). Dans les deux cas, des analyses d’association pangénomique ont été réalisées sur une collection de 137 lignées représentatives de la diversité génétique rencontrée au sein du soya canadien à maturité hâtive. Dans le premier volet, les teneurs en Cys et en Met ont été mesurées par spectroscopie proche infrarouge (NIR) sur des graines produites dans cinq environnements au total. Des données génotypiques pour 2,2 M de polymorphismes mononucléotidiques (SNP) ont été exploitées pour réaliser une analyse d’association. Dans une première phase de découverte, nous avons réussi à identifier un total de dix régions génomiques (QTL) en nous appuyons sur les phénotypes rencontrés dans deux environnements. Afin d’assurer la fiabilité ainsi que la reproductibilité de ces QTL, nous avons validé une forte majorité de ces QTL dans trois environnements additionnels. Ces QTL, dont la plupart sont inédits, nous ont permis d’identifier deux gènes candidats fort prometteurs codant pour des protéines impliquées dans la synthèse de la cystéine. Dans le deuxième volet, les teneurs en éléments minéraux ont été mesurées chez les 137 lignées à l’aide d’un spectromètre de fluorescence à rayons X (XRF) sur des grains récoltés dans cinq environnements. Les analyses d’association ont été réalisées avec le même jeu de données génotypiques (2,2 M de SNP) que dans le volet précédant. Huit QTL significativement associés à la teneur en Ca, K, P et S ont été identifiés de manière robuste à l’aide d’au moins deux modèles statistiques différents (sur les trois employés). La reproductibilité de ces QTL dans trois environnements additionnels a fait l’objet d’une seconde analyse pour des fins de validation. Une forte reproductibilité de l’effet de ces régions génomiques sur ces phénotypes a été observée par la validation de sept QTL sur huit. Trois gènes candidats ont été identifié impliqués soit dans le transport ou l’assimilation de ces éléments minéraux. Par rapport aux études précédentes, la forte densité de marqueurs utilisés dans cette étude a contribué à la détection reproductible de plusieurs nouveaux loci associés à la teneur en acides aminés soufrés ou en éléments minéraux. De plus, cela a rendu possible l’identification de gènes candidats prometteurs. Les marqueurs et les gènes identifiés dans cette étude seront utiles pour l'amélioration génétique du soya à travers la sélection génétique assistée par marqueur.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,003 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,002 | 0,003 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,001 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,006 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».