MétaCan
Menu
Retour à la cohorte
Enregistrement W4200365875 · doi:10.22541/au.163827914.48781130/v1

Empirical evaluation of fundamental principles of evidence-based medicine: a meta-epidemiological study

2021· preprint· en· W4200365875 sur OpenAlexaff
Benjamin Djulbegović, Muhammad Muneeb Ahmed, Iztok Hozo, Despina Koletsi, Lars G. Hemkens, Amy Price, Rachel Riera, Paulo Nadanovsky, Ana Paula Pires dos Santos, Daniela Oliveira de Melo, Ranjan Pathak, Rafael Leite Pacheco, Luis Eduardo Santos Fontes, David Nunan

Notice bibliographique

Revuenon disponible
Typepreprint
Langueen
DomaineDecision Sciences
ThématiqueMeta-analysis and systematic reviews
Établissements canadiensMcMaster University
Organismes subventionnairesnon disponible
Mots-clésGrading (engineering)Meta-analysisMedicineOdds ratioSystematic reviewPublication biasStatisticsMEDLINEEconometricsInternal medicineMathematicsChemistry

Résumé

récupéré en direct d'OpenAlex

Rationale, aims and objectives 39 Evidence-based medicine (EBM) holds that estimates of effects of health interventions based on 40 high-certainty evidence (CoE) are expected to change less frequently than the effects generated 41 in low CoE studies. However, this foundational principle of EBM has never been empirically 42 tested. 43 Methods 44 We reviewed all systematic reviews and meta-analyses in Cochrane Database of Systematic 45 Reviews from January 2016 through May 2021 (n=3,323). We identified 414(207x2) and 384 46 (192x2) pairs of original and updated Cochrane reviews that assessed CoE and pooled 47 treatment effect estimates. We appraised CoE using the Grading of Recommendations 48 Assessment, Development and Evaluation (GRADE) method. We assessed the difference in 49 effect sizes between the original versus updated reviews as a function of change in CoE, which 50 we report as a ratio of odds ratio (ROR). We compared ROR generated in the studies that 51 changed CoE from very low/low (VL/L) to moderate/high (M/H) vs. MH/H VL/L. We also 52 assessed the heterogeneity and inconsistency (using the tau and I2 statistic), the change in 53 precision of effect estimates (by calculating the ratio of standard errors) (seR), and the absolute 54 deviation in estimates of treatment effects (aROR). 55 Results 56 57 We found that CoE originally appraised as VL/L had 2.1 (95%CI: 1.19 to 4.12; p=0.0091) times 58 higher odds to be changed in the future studies than M/H CoE. However, the effect size was not 59 different when CoE changed from VL/L M/H vs. M/H VL/L [ROR=1.02 (95%CI: 0.74 to 1.39) 60 vs. 1.02 (95%CI: 0.44 to 2.37); p=1 for the between subgroup differences]. aROR was similar 61 between the subgroups [median (IQR):1.12 (1.07 to 1.57) vs 1.21 (1.12 to 2.43)]. We observed 62 large inconsistency (I 2=99%) and imprecision in treatment effects (seR=1.09). 63 Conclusions 64 We provide the first empirical support for a foundational principle of EBM showing that low65 quality evidence changes more often than high CoE. However, the effect size was not different 66 between studies with low vs high CoE. The finding that the effect size did not differ between low 67 and high CoE indicate urgent need to refine current EBM critical appraisal methods

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Étiquettes directes de modèles (non validées)

Étiquettes de catégorie et de devis d'étude par modèle, issues des rondes d'étiquetage. C'est une sortie machine, non validée, et le désaccord entre modèles est livré comme donnée. Aucun devis ici n'est encore validé contre MEDLINE.

BrasCatégoriesDevis d'étudeConfiance
gemmaMétarechercheMéta-épidémiologie (sens large)
Domaine: Méthodes · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Observationnelhigh
gptMétarechercheMéta-épidémiologie (sens strict)Méta-épidémiologie (sens large)
Domaine: Évaluation · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Observationnelhigh
modèles en désaccordL'accord compare des ensembles de catégories et des devis identiques entre les bras.

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,296
score de la tête « metaresearch » (Gemma)0,604
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Méta-épidémiologie (sens strict), Méta-épidémiologie (sens large)
Catégories consensuellesMétarecherche
DomaineSignal candidat: Méthodes · Signal consensuel: aucune
Devis d'étudeSignal candidat: Méta-analyse · Signal consensuel: Méta-analyse
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,997
Score d'incertitude au seuil0,869

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,2960,604
Méta-épidémiologie (sens strict)0,0030,003
Méta-épidémiologie (sens large)0,0150,027
Bibliométrie0,0150,013
Études des sciences et des technologies0,0010,003
Communication savante0,0100,007
Science ouverte0,0050,004
Intégrité de la recherche0,0060,004
Charge utile insuffisante (le modèle a refusé de juger)0,0050,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,992
Tête enseignante GPT0,715
Écart entre enseignants0,278 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Étiqueté directement par 2 modèles lisant le dossier complet.

MétarechercheMéta-épidémiologie (sens large)Méta-épidémiologie (sens strict)

Les modèles divergent sur des parties de cette classification; chaque voix est préservée dans la section en fin de page.

Devis d'étudeObservationnel
DomaineMéthodes · Évaluation
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2021
Routes d'admission1
Résumé présentoui

Explorer davantage

Même sujetMeta-analysis and systematic reviewsCatégorieMétarechercheTravaux en français237 207