MétaCan
Menu
Retour à la cohorte
Enregistrement W2626910779 · doi:10.1111/bju.13930

Critical appraisal of the application of propensity score methods in the urology literature

2017· article· en· W2626910779 sur OpenAlexaff
Madhur Nayan, Robert J. Hamilton, David N. Juurlink, Antonio Finelli, Girish S. Kulkarni, Peter C. Austin

Notice bibliographique

RevueBritish Journal of Urology · 2017
Typearticle
Langueen
DomaineMathematics
ThématiqueAdvanced Causal Inference Techniques
Établissements canadiensInstitute for Clinical Evaluative SciencesSunnybrook Health Science CentrePrincess Margaret Cancer CentreUniversity Health NetworkUniversity of TorontoHealth Sciences Centre
Organismes subventionnairesnon disponible
Mots-clésCritical appraisalPropensity score matchingUrologyMedicinePsychologyInternal medicineAlternative medicinePathology

Résumé

récupéré en direct d'OpenAlex

OBJECTIVES: To determine whether studies that used propensity score (PS) methods in the urology literature provide sufficient detail to allow scientific reproducibility and whether appropriate statistical tests were used to obtain valid measures of effect. MATERIALS AND METHODS: We searched OVID Medline and the Science Citation Index from inception to November 2016 to identify studies that used PS methods in five general urology journals. From each included article, we extracted pertinent information related to the PS methodology, such as estimation of the PS, whether balance diagnostics were performed, and the statistical analysis performed. RESULTS: We identified 114 articles for inclusion. Matching on the PS was the most common method used (62 studies, 54.4%). Of all studies, 103 (90.4%) described which covariates were used to estimate the PS; however, only 24 provided justification for the selected covariates. Although the majority of studies (70.2%) performed some sort of diagnostic evaluation to assess balance, few studies (24.6%) used appropriate methods for balance assessment. Only four (6.4%) studies that used PS matching provided sufficient detail to replicate the matching strategy. Finally, the majority (77.4%) of studies that used PS matching explicitly used inappropriate statistical methods to estimate the effect of an exposure on an outcome. CONCLUSIONS: In the urology literature PS methods were poorly described and implemented. We provide recommendations for improvement to allow scientific reproducibility and obtain valid measures of effect from their use.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,518
score de la tête « metaresearch » (Gemma)0,863
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesMétarecherche
DomaineSignal candidat: Méthodes · Signal consensuel: Méthodes
Devis d'étudeSignal candidat: Revue systématique · Signal consensuel: Revue systématique
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,482
Score d'incertitude au seuil0,594

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,5180,863
Méta-épidémiologie (sens strict)0,0030,003
Méta-épidémiologie (sens large)0,0090,013
Bibliométrie0,0530,024
Études des sciences et des technologies0,0040,009
Communication savante0,0140,011
Science ouverte0,0070,007
Intégrité de la recherche0,0060,005
Charge utile insuffisante (le modèle a refusé de juger)0,0070,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,133
Tête enseignante GPT0,472
Écart entre enseignants0,338 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.

Devis d'étudeRevue systématique
DomaineMéthodes
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations10
Publié2017
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueBritish Journal of UrologyMême sujetAdvanced Causal Inference TechniquesTravaux en français237 207