MétaCan
Menu
Retour à la cohorte
Enregistrement W2801786524 · doi:10.1002/lary.27183

The fragility of statistically significant findings from randomized trials in head and neck surgery

2018· review· en· W2801786524 sur OpenAlexaff
Christopher W. Noel, Caitlin P. McMullen, Christopher M. K. L. Yao, Eric Monteiro, David P. Goldstein, Antoine Eskander, John R. de Almeida

Notice bibliographique

RevueThe Laryngoscope · 2018
Typereview
Langueen
DomaineDecision Sciences
ThématiqueMeta-analysis and systematic reviews
Établissements canadiensPrincess Margaret Cancer CentreUniversity of TorontoUniversity Health NetworkSunnybrook Health Science CentreHealth Sciences CentreMount Sinai Hospital
Organismes subventionnairesnon disponible
Mots-clésMedicineInterquartile rangeRandomized controlled trialSample size determinationHead and neck cancerStatistical significanceMeta-analysisHead and neckInternal medicineSurgeryRadiation therapy

Résumé

récupéré en direct d'OpenAlex

OBJECTIVES: The Fragility Index (FI) is a novel tool for evaluating the robustness of statistically significant findings in a randomized control trial (RCT). It measures the number of events upon which statistical significance depends. We sought to calculate the FI scores for RCTs in the head and neck cancer literature where surgery was a primary intervention. DATA SOURCES: Potential articles were identified in PubMed (MEDLINE), Embase, and Cochrane without publication date restrictions. REVIEW METHODS: Two reviewers independently screened eligible RCTs reporting at least one dichotomous and statistically significant outcome. The data from each trial were extracted and the FI scores were calculated. Associations between trial characteristics and FI were determined. RESULTS: In total, 27 articles were identified. The median sample size was 67.5 (interquartile range [IQR] = 42-143) and the median number of events per trial was 8 (IQR = 2.25-18.25). The median FI score was 1 (IQR = 0-2.5), meaning that changing one patient from a nonevent to an event in the treatment arm would change the result to a statistically nonsignificant result, or P > .05. The FI score was less than the number of patients lost to follow-up in 71% of cases. The FI score was found to be moderately correlated with P value (ρ = -0.52, P = .007) and with journal impact factor (ρ = 0.49, P = .009) on univariable analysis. On multivariable analysis, only the P value was found to be a predictor of FI score (P = .001). CONCLUSIONS: Randomized trials in the head and neck cancer literature where surgery is a primary modality are relatively nonrobust statistically with low FI scores. Laryngoscope, 128:2094-2100, 2018.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,632
score de la tête « metaresearch » (Gemma)0,503
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Méta-épidémiologie (sens large), Charge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesMétarecherche, Charge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Sans objet · Signal consensuel: aucune
GenreSignal candidat: Synthèse · Signal consensuel: Synthèse
Score de désaccord entre enseignants0,865
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,6320,503
Méta-épidémiologie (sens strict)0,0010,000
Méta-épidémiologie (sens large)0,0410,007
Bibliométrie0,0000,001
Études des sciences et des technologies0,0000,001
Communication savante0,0010,000
Science ouverte0,0030,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0040,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,778
Tête enseignante GPT0,560
Écart entre enseignants0,217 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeSans objet
Domainenon disponible
GenreSynthèse

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations33
Publié2018
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueThe LaryngoscopeMême sujetMeta-analysis and systematic reviewsTravaux en français237 207