MétaCan
Menu
Retour à la cohorte
Enregistrement W2605512437 · doi:10.23889/ijpds.v1i1.384

An International Cross-cohort Harmonization and Data Integration Initiative towards Achieving Statistical Power and Meaningful Results

2017· article· en· W2605512437 sur OpenAlexaff
Tanya Flanagan, Isabel Fortier, Mélanie Fon Sing, Céline Moore

Notice bibliographique

RevueInternational Journal for Population Data Science · 2017
Typearticle
Langueen
DomaineEnvironmental Science
ThématiqueHealth, Environment, Cognitive Aging
Établissements canadiensCanadian Partnership Against Cancer
Organismes subventionnairesnon disponible
Mots-clésHarmonizationMetadataData scienceComputer scienceMedicineInformation retrievalWorld Wide Web

Résumé

récupéré en direct d'OpenAlex

ABSTRACT ObjectivesThe complex interaction between lifestyle, behaviours, genetic factors and the social and physical environment have a fundamental role in modulating risk and/ or progression of health outcomes, especially cancer. To address this complexity, access to large-scale cohorts involving hundreds of thousands of participants and collecting comprehensive and valuable information are required. In the real world however, attaining adequate statistical power presents a major challenge. Retrospective data harmonization and integration across multiple cohort studies has been shown to be an effective analytical approach to attaining statistical power, with the potential to support population health research and policy related questions and improve our understanding of the complex factors affecting health outcomes. ApproachLarge cohorts, with at least 50,000 participants, initiated in countries all over the world, focused on innovative research on cancer and other chronic diseases were invited to participate in this retrospective data harmonization initiative. Cohorts shared their comprehensive metadata related to their study content and design. Almost 150 variables, selected for their relevance to be part of a generic set of information useful for a broad range of research question, were assessed for their harmonization potential and made available on an online searchable study catalogue. Lastly, a proof of concept research question on the retrospective harmonized data was conducted and aimed to investigate methods to analyze individual patient data from multiple studies by studying the determinants associated with age at menopause. ResultsEight cohorts from multiple countries shared their comprehensive metadata related to their study content and design, resulting in over 2 million study participants. Of the 150 potential variables, the majority of them were harmonizable for co-analysis. The proof of concept research question, applied to these variables generated interesting results, widely supported by other research on this topic, found in the literature. This work demonstrates the value of retrospective data harmonization and integration to be an effective analytical approach to attaining statistical power. The searchable study catalogue, available online for researchers to use in their own international research projects offers a new innovative tool for potential co-analysis of similar measures collected by separate cohort studies. ConclusionRetrospective harmonization offers an innovative approach to optimize use of existing research data with increased statistical power.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,610
score de la tête « metaresearch » (Gemma)0,451
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesMétarecherche
DomaineSignal candidat: Méthodes · Signal consensuel: aucune
Devis d'étudeSignal candidat: Théorique ou conceptuel · Signal consensuel: aucune
GenreSignal candidat: Méthodes · Signal consensuel: Méthodes
Score de désaccord entre enseignants0,390
Score d'incertitude au seuil0,480

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,6100,451
Méta-épidémiologie (sens strict)0,0020,003
Méta-épidémiologie (sens large)0,0030,008
Bibliométrie0,0100,015
Études des sciences et des technologies0,0040,005
Communication savante0,0120,010
Science ouverte0,0120,044
Intégrité de la recherche0,0040,007
Charge utile insuffisante (le modèle a refusé de juger)0,0170,005

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,106
Tête enseignante GPT0,453
Écart entre enseignants0,346 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.

Devis d'étudeThéorique ou conceptuel
DomaineMéthodes
GenreMéthodes

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations4
Publié2017
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueInternational Journal for Population Data ScienceMême sujetHealth, Environment, Cognitive AgingTravaux en français237 207