MétaCan
Menu
Retour à la cohorte
Enregistrement W4366122282 · doi:10.1177/20539517231163174

Recording the ethical provenance of data and automating data stewardship

2023· article· en· W4366122282 sur OpenAlexafffund
Alexander Bernier, Maili Raven-Adams, Davide Zaccagnini, Bartha Maria Knoppers

Notice bibliographique

RevueBig Data & Society · 2023
Typearticle
Langueen
DomaineMedicine
ThématiqueEthics in Clinical Research
Établissements canadiensMcGill University
Organismes subventionnairesFonds de Recherche du Québec - SantéCanadian Institutes of Health ResearchEuropean Commission
Mots-clésStewardship (theology)InteroperabilityData governanceCompromiseNormativeData scienceData exchangeComputer scienceScale (ratio)Knowledge managementBusinessPolitical scienceData qualityLawWorld Wide Web

Résumé

récupéré en direct d'OpenAlex

Health organisations use numerous different mechanisms to collect biomedical data, to determine the applicable ethical, legal and institutional conditions of use, and to reutilise the data in accordance with the relevant rules. These methods and mechanisms differ from one organisation to another, and involve considerable specialised human labour, including record-keeping functions and decision-making committees. In reutilising data at scale, however, organisations struggle to meet demands for data interoperability and for rapid inter-organisational data exchange due to reliance on legacy paper-based records and on the human-initiated administration of accompanying permissions in data. The adoption of permissions-recording, and permissions-administration tools that can be implemented at scale across numerous organisations is imperative. Further, these must be implemented in a manner that does not compromise the nuanced and contextual adjudicative processes of research ethics committees, data access committees, and biomedical research organisations. The tools required to implement a streamlined system of biomedical data exchange have in great part been developed. Indeed, there remains but a small core of functions that must further be standardised and automated to enable the recording and administration of permissions in biomedical research data with minimal human effort. Recording ethical provenance in this manner would enable biomedical data exchange to be performed at scale, in full respect of the ethical, legal, and institutional rules applicable to different datasets. This despite foundational differences between the distinct legal and normative frameworks is applicable to distinct communities and organisations that share data between one another.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,267
score de la tête « metaresearch » (Gemma)0,416
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Science ouverte
Catégories consensuellesMétarecherche
DomaineSignal candidat: Reproductibilité · Signal consensuel: aucune
Devis d'étudeSignal candidat: Théorique ou conceptuel · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,995
Score d'incertitude au seuil0,903

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,2670,416
Méta-épidémiologie (sens strict)0,0010,002
Méta-épidémiologie (sens large)0,0020,002
Bibliométrie0,0070,008
Études des sciences et des technologies0,0080,019
Communication savante0,0240,026
Science ouverte0,0050,022
Intégrité de la recherche0,0050,010
Charge utile insuffisante (le modèle a refusé de juger)0,0050,007

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,829
Tête enseignante GPT0,607
Écart entre enseignants0,222 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.

Devis d'étudeThéorique ou conceptuel
DomaineReproductibilité
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations10
Publié2023
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueBig Data & SocietyMême sujetEthics in Clinical ResearchTravaux en français237 207