MétaCan
Menu
Retour à la cohorte
Enregistrement W2606743718 · doi:10.23889/ijpds.v1i1.77

Record Linkage Project Process Model

2017· article· en· W2606743718 sur OpenAlexaffabout
Richard Trudeau

Notice bibliographique

RevueInternational Journal for Population Data Science · 2017
Typearticle
Langueen
DomaineDecision Sciences
ThématiqueData Quality and Management
Établissements canadiensStatistics Canada
Organismes subventionnairesnon disponible
Mots-clésRecord linkageLinkage (software)Linked dataProcess (computing)Computer scienceSession (web analytics)Information retrievalData scienceWorld Wide WebSociologyDemographyPopulation

Résumé

récupéré en direct d'OpenAlex

ABSTRACTObjectivesIn April 2015, a Working Group on Record Linkage was created at Statistics Canada with the objective of achieving a common understanding of the concepts and processes involved in record linkage projects at Statistics Canada. ApproachA generic record linkage process model was mapped to reflect the general practices and activities involved in record linkage at Statistics Canada. The model was developed with a view for more general use by other statistical agencies involved in record linkage. It was built on the Generic Statistical Business Process Model v5.0 developed by the Joint UNECE/Eurostat/OECD Work Session on Statistical Metadata (METIS) for survey purposes. It also builds on international models of record linkage from Australia and the United States as well as record linkage methodology used at Statistics Canada. In addition, it was informed by the relevant legal and policy frameworks that govern all of Statistics Canada statistical activities. Over one hundred people involved in all aspects of record linkage at Statistics Canada were consulted during this process.ResultsAn activity-oriented Record Linkage Project Process Model was drafted and proposed as a standard for the agency. It breaks down the record linkage process into three meta-phases: project planning, record linkage, post-linkage activities. Each meta-phase is further divided into phases and sub-phases that describe the activities of the record linkage project from specification of needs to project close-out and evaluation. An additional feature of the model is a description of the outcome of each phase that can be used as a milestone marker or as a gateway to the next phase. ConclusionAs a descriptive model, the Record Linkage Project Process Model will inform management on the range of activities related to a record linkage project that go well beyond the function of matching records between two data files. It can also be used as a prescriptive model that will provide guidance to individuals engaging in a record linkage project.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,051
score de la tête « metaresearch » (Gemma)0,062
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Théorique ou conceptuel · Signal consensuel: Théorique ou conceptuel
GenreSignal candidat: Méthodes · Signal consensuel: Méthodes
Score de désaccord entre enseignants0,200
Score d'incertitude au seuil0,398

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,0510,062
Méta-épidémiologie (sens strict)0,0010,001
Méta-épidémiologie (sens large)0,0010,002
Bibliométrie0,0060,011
Études des sciences et des technologies0,0050,003
Communication savante0,0160,010
Science ouverte0,0070,007
Intégrité de la recherche0,0050,003
Charge utile insuffisante (le modèle a refusé de juger)0,0250,009

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,592
Tête enseignante GPT0,615
Écart entre enseignants0,023 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeThéorique ou conceptuel
Domainenon disponible
GenreMéthodes

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations4
Publié2017
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueInternational Journal for Population Data ScienceMême sujetData Quality and ManagementTravaux en français237 207