The Consensus on Exercise Reporting Template (CERT) in a systematic review of exercise-based rehabilitation effectiveness: completeness of reporting, rater agreement, and utility
Notice bibliographique
Résumé
BACKGROUND: Rehabilitation interventions are diverse - making decisions about pooling data in meta-analyses challenging. Intervention reporting templates such as the Consensus on Exercise Reporting Template (CERT) may help reviewers document intervention variability. AIM: To assess inter-rater agreement and utility of CERT used to assess completeness of reporting of one rehabilitation exercise intervention: pelvic floor muscle training (PFMT). DESIGN: A non-experimental agreement study. SETTING: Update of the Cochrane systematic review comparing different approaches to PFMT for urinary incontinence in women. POPULATION: Two PFMT arms from 21 newly identified trials. METHODS: Five raters independently used CERT to assess sufficiency of reporting of each arm (experimental PFMT and control PFMT) of each trial. One rater, PFMT non-expert, rated all trials. Four raters, all PFMT experts, assessed a mutually exclusive subgroup of the trials. In addition to rating sufficiency - "Yes" compared to No" or "Uncertain" - raters also reported on CERT utility. Expert ratings were used to determine the proportion of CERT items rated as sufficiently reported. Rater agreement was estimated using coefficient kappa and McNemar's test. RESULTS: The range of CERT items rated as sufficiently reported was 0 to 15 of 19 items, and the mean for both trial arms was 5.5. For agreement, 11 of 19 items had sufficient data to estimate coefficient kappa and only 3 of 11 had a kappa >0.4 (moderate agreement). From the 12 of 19 items for which McNemar's test could be performed, five had evidence that PFMT experts more often rated the reporting as sufficient than the non-expert. Raters reported the CERT template was comprehensive but not complete and needed contextualizing for PFMT. CONCLUSIONS: Completeness of reporting was poor for this example of a rehabilitation exercise intervention, and equally poor in both trial arms. Inter-rater agreement of completeness of reporting was also poor. Using a data extraction tool with poor rater-agreement may add unnecessary burden in a review. However, using a data extraction tool that enables assessment of intervention homogeneity has benefits in making decisions about which data to pool or not. CLINICAL REHABILITATION IMPACT: Researchers reporting clinical trials must pay more attention to completeness of rehabilitation exercise reporting.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,014 | 0,029 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,006 | 0,001 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,001 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».