Linking international registries to FHIR and Phenopackets with RareLink: a scalable REDCap-based framework for rare disease data interoperability
Notice bibliographique
Résumé
, an open-source framework implementing our previously-published ontology-based rare disease common data model, enabling standardised data exchange between REDCap, international registries, and downstream analysis tools. Its preconfigured pipelines interact with the local REDCap application programming interface and enable semi-automatic import or export of data to the Global Alliance for Genomics and Health (GA4GH) Phenopackets and Health Level 7 (HL7) Fast Healthcare Interoperability Resources (FHIR) instances, conforming to the HL7 International Patient Summary and Genomics Reporting profiles. The framework was developed in three iterative phases using retrospective and prospective clinical data from patients with various rare metabolic and neuromuscular disorders, as well as inborn errors of immunity. Phase one involved deployment across four German university hospitals for registry and data analysis purposes. Phase two integrated RareLink with the Canadian Inborn Errors of Immunity National Registry, enhancing extensibility. Phase three focuses on international implementation in South Africa and Japan to assess global scalability. Implementation feedback was continuously incorporated to validate outputs and improve usability. For evaluation purposes, we defined a simulated Kabuki syndrome cohort based on published cases and demonstrated data export to both Phenopackets and FHIR instances. RareLink can enhance the clinical utility of REDCap by enabling structured data analysis and interoperability. Its global applicability and open-source nature can support equitable rare disease research with the ultimate goal to improve patient care. Broader adoption and coordination with entities such as HL7 and the European Reference Networks are thus essential to realise its full potential. The framework and its documentation are freely available through GitHub and Read the Docs, respectively.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,024 | 0,035 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,002 |
| Méta-épidémiologie (sens large) | 0,001 | 0,004 |
| Bibliométrie | 0,008 | 0,005 |
| Études des sciences et des technologies | 0,002 | 0,002 |
| Communication savante | 0,009 | 0,010 |
| Science ouverte | 0,006 | 0,015 |
| Intégrité de la recherche | 0,002 | 0,004 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,007 | 0,006 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».