MétaCan
Menu
Retour à la cohorte
Enregistrement W4385416481 · doi:10.7554/elife.88149

Risk factors affecting polygenic score performance across diverse cohorts

2023· article· en· W4385416481 sur OpenAlexaff
Daniel Hui, Scott Dudek, Krzysztof Kiryluk, Theresa L. Walunas, Iftikhar J. Kullo, Wei‐Qi Wei, Hemant K. Tiwari, Josh F. Peterson, Wendy K. Chung, Brittney H. Davis, Atlas Khan, Leah C. Kottyan, Nita A. Limdi, QiPing Feng, Megan J. Puckelwartz, Chunhua Weng, Johanna L. Smith, Elizabeth W. Karlson, Gail P. Jarvik, Marylyn D. Ritchie

Notice bibliographique

RevueeLife · 2023
Typearticle
Langueen
DomaineBiochemistry, Genetics and Molecular Biology
ThématiqueGenetic Associations and Epidemiology
Établissements canadiensColumbia College
Organismes subventionnairesNational Center for Advancing Translational SciencesNational Institute of Arthritis and Musculoskeletal and Skin DiseasesNational Institute of Diabetes and Digestive and Kidney DiseasesNational Human Genome Research InstituteVanderbilt University Medical CenterPerelman School of Medicine, University of PennsylvaniaRegeneron PharmaceuticalsNational Institutes of HealthNational Heart, Lung, and Blood InstituteUniversity of Pennsylvania Health SystemUniversity of California, San FranciscoEllison Medical FoundationUniversity of WashingtonGeorgia Clinical and Translational Science AllianceCincinnati Children's Hospital Medical CenterNational Institute on AgingColumbia UniversityNorthwestern UniversityKaiser PermanenteBrigham and Women's HospitalNational Institute of Allergy and Infectious DiseasesMayo ClinicWayne and Gladys Valley FoundationUniversity of Pennsylvania
Mots-clésPolygenic risk scoreDemographyMedicineBiologyGeneticsSingle-nucleotide polymorphismGenotypeGene

Résumé

récupéré en direct d'OpenAlex

Apart from ancestry, personal or environmental covariates may contribute to differences in polygenic score (PGS) performance. We analyzed the effects of covariate stratification and interaction on body mass index (BMI) PGS (PGS BMI ) across four cohorts of European (N = 491,111) and African (N = 21,612) ancestry. Stratifying on binary covariates and quintiles for continuous covariates, 18/62 covariates had significant and replicable R 2 differences among strata. Covariates with the largest differences included age, sex, blood lipids, physical activity, and alcohol consumption, with R 2 being nearly double between best- and worst-performing quintiles for certain covariates. Twenty-eight covariates had significant PGS BMI –covariate interaction effects, modifying PGS BMI effects by nearly 20% per standard deviation change. We observed overlap between covariates that had significant R 2 differences among strata and interaction effects – across all covariates, their main effects on BMI were correlated with their maximum R 2 differences and interaction effects (0.56 and 0.58, respectively), suggesting high-PGS BMI individuals have highest R 2 and increase in PGS effect. Using quantile regression, we show the effect of PGS BMI increases as BMI itself increases, and that these differences in effects are directly related to differences in R 2 when stratifying by different covariates. Given significant and replicable evidence for context-specific PGS BMI performance and effects, we investigated ways to increase model performance taking into account nonlinear effects. Machine learning models (neural networks) increased relative model R 2 (mean 23%) across datasets. Finally, creating PGS BMI directly from GxAge genome-wide association studies effects increased relative R 2 by 7.8%. These results demonstrate that certain covariates, especially those most associated with BMI, significantly affect both PGS BMI performance and effects across diverse cohorts and ancestries, and we provide avenues to improve model performance that consider these effects.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,009
score de la tête « metaresearch » (Gemma)0,012
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,009
Score d'incertitude au seuil0,047

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,0090,012
Méta-épidémiologie (sens strict)0,0010,000
Méta-épidémiologie (sens large)0,0010,001
Bibliométrie0,0010,001
Études des sciences et des technologies0,0010,001
Communication savante0,0010,000
Science ouverte0,0000,001
Intégrité de la recherche0,0000,001
Charge utile insuffisante (le modèle a refusé de juger)0,0020,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,022
Tête enseignante GPT0,289
Écart entre enseignants0,268 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations6
Publié2023
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueeLifeMême sujetGenetic Associations and EpidemiologyTravaux en français237 207