MétaCan
Menu
Retour à la cohorte
Enregistrement W2770107865 · doi:10.1136/bmjopen-2017-018593

UpToDate adherence to GRADE criteria for strong recommendations: an analytical survey

2017· article· en· W2770107865 sur OpenAlexaff
Thomas Agoritsas, Arnaud Merglen, Anja Fog Heen, Annette Kristiansen, Ignacio Neumann, Juan P. Brito, Romina Brignardello‐Petersen, Paul Alexander, David M. Rind, Per Olav Vandvik, Gordon Guyatt

Notice bibliographique

RevueBMJ Open · 2017
Typearticle
Langueen
DomaineHealth Professions
ThématiqueHealthcare cost, quality, practices
Établissements canadiensMcMaster UniversityImpact
Organismes subventionnairesnon disponible
Mots-clésMedicineFamily medicineEpidemiologyPublic healthMEDLINEMedical educationNursingInternal medicine

Résumé

récupéré en direct d'OpenAlex

INTRODUCTION: UpToDate is widely used by clinicians worldwide and includes more than 9400 recommendations that apply the Grading of Recommendations Assessment, Development and Evaluation (GRADE) framework. GRADE guidance warns against strong recommendations when certainty of the evidence is low or very low (discordant recommendations) but has identified five paradigmatic situations in which discordant recommendations may be justified. OBJECTIVES: Our objective was to document the strength of recommendations in UpToDate and assess the frequency and appropriateness of discordant recommendations. DESIGN: Analytical survey of all recommendations in UpToDate. METHODS: We identified all GRADE recommendations in UpToDate and examined their strength (strong or weak) and certainty of the evidence (high, moderate or low certainty). We identified all discordant recommendations as of January 2015, and pairs of reviewers independently classified them either into one of the five appropriate paradigms or into one of three categories inconsistent with GRADE guidance, based on the evidence presented in UpToDate. RESULTS: UpToDate included 9451 GRADE recommendations, of which 6501 (68.8%) were formulated as weak recommendations and 2950 (31.2%) as strong. Among the strong, 844 (28.6%) were based on high certainty in effect estimates, 1740 (59.0%) on moderate certainty and 366 (12.4%) on low certainty. Of the 349 discordant recommendations 204 (58.5%) were judged appropriately (consistent with one of the five paradigms); we classified 47 (13.5%) as good practice statements; 38 (10.9%) misclassified the evidence as low certainty when it was at least moderate and 60 (17.2%) warranted a weak rather than a strong recommendation. CONCLUSION: The proportion of discordant recommendations in UpToDate is small (3.7% of all recommendations) and the proportion that is truly problematic (strong recommendations that would best have been weak) is very small (0.6%). Clinicians should nevertheless be cautious and look for clear explanations-in UpToDate and elsewhere-when guidelines offer strong recommendations based on low certainty evidence.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Étiquettes directes de modèles (non validées)

Étiquettes de catégorie et de devis d'étude par modèle, issues des rondes d'étiquetage. C'est une sortie machine, non validée, et le désaccord entre modèles est livré comme donnée. Aucun devis ici n'est encore validé contre MEDLINE.

BrasCatégoriesDevis d'étudeConfiance
gptMétarecherche
Domaine: Évaluation · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Observationnelhigh
grokMétarecherche
Domaine: Méthodes · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Observationnelhigh
opusMétarecherche
Domaine: Méthodes · Genre: Empirique
Porte sur le système de recherche canadien: non · Porte sur un sujet canadien: non
Autre devismedium
modèles en désaccordL'accord compare des ensembles de catégories et des devis identiques entre les bras.

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,300
score de la tête « metaresearch » (Gemma)0,739
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesaucune
DomaineSignal candidat: Présentation des résultats · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,700
Score d'incertitude au seuil0,000

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,3000,739
Méta-épidémiologie (sens strict)0,0020,003
Méta-épidémiologie (sens large)0,0070,009
Bibliométrie0,0240,022
Études des sciences et des technologies0,0030,003
Communication savante0,0090,009
Science ouverte0,0090,008
Intégrité de la recherche0,0060,006
Charge utile insuffisante (le modèle a refusé de juger)0,0080,005

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,953
Tête enseignante GPT0,758
Écart entre enseignants0,195 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Étiqueté directement par 3 modèles lisant le dossier complet.

Métarecherche

Les modèles divergent sur des parties de cette classification; chaque voix est préservée dans la section en fin de page.

Devis d'étudeObservationnel · Autre devis
DomaineÉvaluation · Méthodes
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations39
Publié2017
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueBMJ OpenMême sujetHealthcare cost, quality, practicesCatégorieMétarechercheTravaux en français237 207