MétaCan
Menu
Retour à la cohorte
Enregistrement W2281959534 · doi:10.1186/1745-6215-16-s2-o81

Do pragmatic trials trade-off internal validity for external validity?

2015· article· en· W2281959534 sur OpenAlexaff
Kirsty Loudon, Merrick Zwarenstein, Frank Sullivan, Peter T. Donnan, Shaun Treweek

Notice bibliographique

RevueTrials · 2015
Typearticle
Langueen
DomaineEconomics, Econometrics and Finance
ThématiqueHealth Systems, Economic Evaluations, Quality of Life
Établissements canadiensUniversity of TorontoWestern University
Organismes subventionnairesnon disponible
Mots-clésExternal validityInternal validityMedicinePsychologySocial psychologyPathology

Résumé

récupéré en direct d'OpenAlex

Trials can be described as being on a design spectrum between highly explanatory (roughly, ‘Can the intervention work?’) to highly pragmatic (‘Does the intervention work in routine care?’). A criticism levelled at trials that take a pragmatic approach is that they sacrifice internal validity for external validity, i.e. there is a trade-off to be made. Proponents of pragmatic trials argue that there is no trade-off. However, both critics and defenders of the pragmatic approach have made their arguments in the absence of empirical evidence one way or the other. As part of our work developing the PRECIS-2 trial design tool, we looked for evidence of the validity trade-off in two ways. Firstly, a sample of 14 cardiovascular explanatory trials was matched to trials of the same intervention but which took a more pragmatic design approach. Secondly, 23 trials included in a Cochrane review of first-line treatment for hypertension were compared. The Cochrane Risk of Bias tool was used to assess internal validity; PRECIS-2 was used to assess design approach. We found no clear difference in Cochrane Risk of Bias assessments between trials taking explanatory and pragmatic approaches. Work with a larger sample of trials is required before we can be completely confident in this result but this represents the first evidence that the suggested trade-off between internal and external validity in trials may be false. This work is part of the Trial Forge initiative to improve trial efficiency.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Étiquettes directes de modèles (non validées)

Étiquettes de catégorie et de devis d'étude par modèle, issues des rondes d'étiquetage. C'est une sortie machine, non validée, et le désaccord entre modèles est livré comme donnée. Aucun devis ici n'est encore validé contre MEDLINE.

BrasCatégoriesDevis d'étudeConfiance
gemmaMétarecherche
Domaine: Méthodes · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Théorique ou conceptuellow
gptMétarecherche
Domaine: Méthodes · Genre: Méthodes
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Théorique ou conceptuellow
modèles en accordL'accord compare des ensembles de catégories et des devis identiques entre les bras.

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,338
score de la tête « metaresearch » (Gemma)0,199
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Méta-épidémiologie (sens strict), Charge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesMétarecherche, Charge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Sans objet · Signal consensuel: Sans objet
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,533
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,3380,199
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0050,001
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,001
Science ouverte0,0010,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0010,002

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,851
Tête enseignante GPT0,557
Écart entre enseignants0,295 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Étiqueté directement par 2 modèles lisant le dossier complet.

Devis d'étudeThéorique ou conceptuel
DomaineMéthodes
GenreEmpirique · Méthodes

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations5
Publié2015
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueTrialsMême sujetHealth Systems, Economic Evaluations, Quality of LifeCatégorieMétarechercheTravaux en français237 207