MétaCan
Menu
Retour à la cohorte
Enregistrement W2988554793 · doi:10.1097/prs.0000000000006102

The Fragility of Statistically Significant Randomized Controlled Trials in Plastic Surgery

2019· review· en· W2988554793 sur OpenAlexaff
Brian Chin, Andrea Copeland, Lucas Gallo, Scott Wakeham, Christopher J. Coroneos, Michael Walsh, Achilleas Thoma, Sophocles H. Voineskos

Notice bibliographique

RevuePlastic & Reconstructive Surgery · 2019
Typereview
Langueen
DomaineDecision Sciences
ThématiqueMeta-analysis and systematic reviews
Établissements canadiensMcMaster UniversityImpactQueen's University
Organismes subventionnairesnon disponible
Mots-clésRandomized controlled trialPercentileFragilityMedicineStatistical significanceSample size determinationExact testSurgeryStatisticsInternal medicineMathematics

Résumé

récupéré en direct d'OpenAlex

BACKGROUND: The fragility index has been proposed as a metric to evaluate the robustness of statistically significant findings in randomized controlled trials. It measures the number of events that a trial result relies on to maintain statistical significance. This study examines the robustness of statistically significant results from randomized controlled trials in the plastic surgery literature. METHODS: A systematic literature search of the 15 highest impact plastic surgery journals was conducted to identify randomized controlled trials published between 2000 and 2017 that reported a statistically significant dichotomous outcome (p < 0.05). The fragility index of each study was calculated using Fisher's exact test. Multiple linear regression was used to determine trial characteristics associated with the fragility index. RESULTS: The 90 eligible randomized controlled trials had a median sample size of 73.5 patients (25th to 75th percentile, 50 to 115) and a median of 20 events (25th to 75th percentile, 11 to 33.5) for the chosen outcome. The median fragility index was 1 (25th to 75th percentile, 0 to 4), indicating that statistical significance would be lost in half of the randomized controlled trials if a single patient had a change in event status. The fragility index was 0 in 24 of 90 (27 percent) randomized controlled trials, meaning the outcome immediately lost statistical significance on recalculation of the p value using Fisher's exact test. CONCLUSIONS: The results of randomized controlled trials in plastic surgery demonstrate substantial fragility, as statistically significant results were found to hinge on a small number of events. The fragility index offers an intuitive and simple metric to complement the p value and determine the confidence in the results of randomized controlled trials.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,688
score de la tête « metaresearch » (Gemma)0,971
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Méta-épidémiologie (sens strict), Méta-épidémiologie (sens large), Charge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesMétarecherche, Méta-épidémiologie (sens strict), Méta-épidémiologie (sens large), Charge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: Méthodes · Signal consensuel: aucune
Devis d'étudeSignal candidat: Autre devis · Signal consensuel: aucune
GenreSignal candidat: Synthèse · Signal consensuel: Synthèse
Score de désaccord entre enseignants0,948
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,6880,971
Méta-épidémiologie (sens strict)0,0020,001
Méta-épidémiologie (sens large)0,1670,046
Bibliométrie0,0030,003
Études des sciences et des technologies0,0000,001
Communication savante0,0010,000
Science ouverte0,0020,000
Intégrité de la recherche0,0010,001
Charge utile insuffisante (le modèle a refusé de juger)0,0080,002

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,647
Tête enseignante GPT0,495
Écart entre enseignants0,152 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeAutre devis
DomaineMéthodes
GenreSynthèse

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations21
Publié2019
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revuePlastic & Reconstructive SurgeryMême sujetMeta-analysis and systematic reviewsTravaux en français237 207