MétaCan
Menu
Retour à la cohorte
Enregistrement W3110853613 · doi:10.23889/ijpds.v5i5.1556

Using the Canadian Institute for Health Information’s Information Quality Framework to Support Integration and Utilization of Complex, Multi-Jurisdictional Data

2020· article· en· W3110853613 sur OpenAlexaffabout
Chrissy Willemse

Notice bibliographique

RevueInternational Journal for Population Data Science · 2020
Typearticle
Langueen
DomaineDecision Sciences
ThématiqueData Quality and Management
Établissements canadiensCanadian Institute for Health Information
Organismes subventionnairesnon disponible
Mots-clésData qualityInformation qualityComputer scienceDocumentationOperationalizationData scienceHealth informaticsQuality (philosophy)Information systemData governanceHealth careKnowledge managementBusinessEngineering

Résumé

récupéré en direct d'OpenAlex

The Canadian Institute for Health Information (CIHI) provides essential information on Canada’s health systems and the health of Canadians. This presentation discusses information quality’s role in the integration and utilization of CIHI’s complex, multi-sector and multi-jurisdictional data.
 IntroductionCIHI’s Data and Information Quality Program is recognized internationally for its comprehensiveness and high standards. As the need for linked data research increases, the requirements on quality continue to grow. CIHI’s multi-sector, multi-jurisdictional healthcare system and the varying health policies, care delivery models, and data collection practices that go with it pose challenges for researchers as they try to pull the data together in a comprehensive way. CIHI’s Information Quality Framework forms the foundation for addressing these challenges and ensuring data are fit for integration and are properly utilized.
 Objectives and ApproachIn 2019, a connected data quality project was initiated to improve the usability of CIHI’s analytical data. Information quality framework concepts were applied across CIHI data sources to better understand data linkage challenges, measure inconsistencies across data sources, identify opportunities to improve data and standards, and develop resources to support users.
 ResultsFindings from the project identified key connected data quality activities for the organization to operationalize. These focus on quality assessment and reporting; harmonization of data standards; expanded documentation and analytical resources; data classification and profiling tools to support descriptive analysis; and new source of truth and pre-linked datasets. Quality activities were prioritized based on need and complexity, and “connected data teams” were established to carry out the work.
 Conclusion / ImplicationsExpansion of CIHI’s quality framework across data sources facilitates its data linkage capabilities and “connected data” use. It enables the evolution of CIHI’s analytical environments and information products from being database specific to integrated-data driven, and facilitates the use of CIHI’s analytical data for research.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,011
score de la tête « metaresearch » (Gemma)0,016
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Communication savante
Catégories consensuellesCommunication savante
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Simulation ou modélisation · Signal consensuel: aucune
GenreSignal candidat: Méthodes · Signal consensuel: aucune
Score de désaccord entre enseignants0,754
Score d'incertitude au seuil0,999

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0110,016
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0010,001
Études des sciences et des technologies0,0010,000
Communication savante0,0020,019
Science ouverte0,0040,001
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,747
Tête enseignante GPT0,598
Écart entre enseignants0,149 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeSimulation ou modélisation
Domainenon disponible
GenreMéthodes

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations1
Publié2020
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueInternational Journal for Population Data ScienceMême sujetData Quality and ManagementTravaux en français237 207