MétaCan
Menu
Retour à la cohorte
Enregistrement W2966296769 · doi:10.1097/bot.0000000000001595

Statistical Significance in Trauma Research: Too Unstable to Trust?

2019· article· en· W2966296769 sur OpenAlexaff
Robert L. Parisien, Jesse Dashe, Patrick K. Cronin, Mohit Bhandari, Paul Tornetta

Notice bibliographique

RevueJournal of Orthopaedic Trauma · 2019
Typearticle
Langueen
DomaineMedicine
ThématiqueHip and Femur Fractures
Établissements canadiensMcMaster University
Organismes subventionnairesnon disponible
Mots-clésMedicineStatistical significanceOrthopedic surgeryFragilitySample size determinationPopulationClinical significanceRandomized controlled trialRetrospective cohort studySurgeryInternal medicineStatistics

Résumé

récupéré en direct d'OpenAlex

OBJECTIVES: To evaluate the stability of statistical findings in the fracture care literature based on minor changes in event rates and to determine the utility of applying both the Fragility Index (FI) and Fragility Quotient (FQ) to comparative orthopaedic trauma trials. METHODS: All fracture care studies from 1991 to 2013 in the Journal of Bone and Joint Surgery and the Journal of Orthopaedic Trauma were screened. The FI was determined by altering the number of reported outcome events, a single event at time, until a reversal of statistical significance was determined. The associated FQ was determined by dividing the FI by the total sample size. RESULTS: Of the 4040 studies evaluated, 198 comparative studies met inclusion criteria with a reported 253 primary and 522 secondary outcome events. There were 118 randomized controlled trials and 80 retrospective comparative studies. Of the 775 total outcome events, 235 were initially reported as significant. The median FI for the entire study was only 5 with an associated FQ of 0.046. This represents just 3.8% of the total study population. CONCLUSIONS: The robustness of comparative trials in the orthopaedic trauma literature may not be as stable as previously thought with only a few event reversals required to alter trial significance. We therefore recommend triple reporting of a P value, FI, and FQ to aid in the evaluation and interpretation of statistical stability and quantitative significance in comparative orthopaedic trauma trials.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,731
score de la tête « metaresearch » (Gemma)0,930
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesMétarecherche
DomaineSignal candidat: Méthodes · Signal consensuel: Méthodes
Devis d'étudeSignal candidat: Théorique ou conceptuel · Signal consensuel: aucune
GenreSignal candidat: Commentaire · Signal consensuel: Commentaire
Score de désaccord entre enseignants0,269
Score d'incertitude au seuil0,332

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,7310,930
Méta-épidémiologie (sens strict)0,0020,003
Méta-épidémiologie (sens large)0,0110,006
Bibliométrie0,0200,018
Études des sciences et des technologies0,0050,045
Communication savante0,0200,018
Science ouverte0,0100,011
Intégrité de la recherche0,0110,022
Charge utile insuffisante (le modèle a refusé de juger)0,0030,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,055
Tête enseignante GPT0,364
Écart entre enseignants0,309 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.

Devis d'étudeThéorique ou conceptuel
DomaineMéthodes
GenreCommentaire

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations55
Publié2019
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueJournal of Orthopaedic TraumaMême sujetHip and Femur FracturesTravaux en français237 207