Spin Is Common in Studies Assessing Robotic Colorectal Surgery
Notice bibliographique
Résumé
BACKGROUND: Spin has been defined previously as "specific reporting that could distort the interpretation of results and mislead readers." OBJECTIVE: The purpose of this study was to determine the frequency and extent of misrepresentation of results in robotic colorectal surgery. DATA SOURCES: Publications referenced in MEDLINE or EMBASE between 1992 and 2014 were included in this study. STUDY SELECTION: Studies comparing robotic colorectal surgery with other techniques with a nonsignificant difference in the primary outcome(s) were included. INTERVENTIONS: Interventions included robotic versus alternative techniques. MAIN OUTCOME MEASURES: Frequency, strategy, and extent of spin, as previously defined, were the main outcome measures RESULTS: : A total of 38 studies (including 24,303 patients) were identified for inclusion in this study. Evidence of spin was found in 82% of studies. The most common form of spin was concluding equivalence between surgical techniques based on nonsignificant differences (76% of abstracts and 71% of conclusions). Claiming improved benefits, despite nonsignificance, was also commonly observed (26% of abstracts and 45% of conclusions). Because of the small sample size, we did not find evidence of an association between spin and study design, type of funding, publication year, or study size. Acknowledging the equivocal nature of the study happened rarely (47% of abstracts and 34% of conclusions). The absence of spin predicted whether authors acknowledged equivocal results (p = 0.02). A total of 50% of studies did not disclose whether they received funding, whereas 39% of studies failed to state whether a conflict of interest existed. LIMITATIONS: A limited number of randomized controlled trials were available. CONCLUSIONS: Spin occurred in >80% of included studies. Many studies concluded that robotic surgery was as safe as more traditional techniques, despite small sample sizes and limited follow-up. Authors often failed to recognize the difference between nonsignificance and equivalence. Failure to disclose financial relationships, which could represent potential conflict(s) of interest, is concerning. Readers of these articles need to be critical of author conclusions, and publishers should ensure that conclusions correspond with the study methods and results.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,318 | 0,617 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,002 |
| Méta-épidémiologie (sens large) | 0,005 | 0,007 |
| Bibliométrie | 0,021 | 0,024 |
| Études des sciences et des technologies | 0,002 | 0,006 |
| Communication savante | 0,007 | 0,008 |
| Science ouverte | 0,003 | 0,008 |
| Intégrité de la recherche | 0,003 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,005 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».