MétaCan
Menu
Retour à la cohorte
Enregistrement W2986493832 · doi:10.1002/jrsm.1385

Construct validity of the Physiotherapy Evidence Database (PEDro) quality scale for randomized trials: Item response theory and factor analyses

2019· article· en· W2986493832 sur OpenAlexafffund
Emiliano Albanese, Lukas Bütikofer, Susan Armijo‐Olivo, Christine Ha, Matthias Egger

Notice bibliographique

RevueResearch Synthesis Methods · 2019
Typearticle
Langueen
DomaineDecision Sciences
ThématiquePsychometric Methodologies and Testing
Établissements canadiensUniversity of Alberta
Organismes subventionnairesCanadian Institutes of Health ResearchAlberta InnovatesSchweizerischer Nationalfonds zur Förderung der Wissenschaftlichen ForschungPhysiotherapy Foundation of CanadaNational Science Foundation
Mots-clésItem response theoryConstruct (python library)Scale (ratio)Construct validityPsychologyRandomized controlled trialClinical psychologyQuality (philosophy)PsychometricsPhysical therapyApplied psychologyMedicineComputer science

Résumé

récupéré en direct d'OpenAlex

BACKGROUND: There is an agreement that the methodological quality of randomized trials should be assessed in systematic reviews, but there is a debate on how this should be done. We conducted a construct validation study of the Physiotherapy Evidence Database (PEDro) scale, which is widely used to assess the quality of trials in physical therapy and rehabilitation. METHODS: We analyzed 345 trials that were included in Cochrane reviews and for which a PEDro summary score was available. We used one- and two-parameter logistic item response theory (IRT) models to study the psychometric properties of the PEDro scale and assessed the items' difficulty and discrimination parameters. We ran goodness of fit post estimations and examined the IRT unidimensionality assumption with a multidimensional IRT (MIRT) model. RESULTS: Out of a maximum of 10, the mean PEDro summary score was 5.46 (SD = 1.51). The allocation concealment and intention-to-treat scale items contributed most of the information on the underlying construct (with discriminations of 1.79 and 2.05, respectively) at similar difficulties (0.63 and 0.65, respectively). The other items provided little additional information and did not distinguish trials of different quality. There was substantial evidence of departure from the unidimensionality assumption, suggesting that the PEDro items relate to more than one latent trait. CONCLUSIONS: Our findings question the construct validity of the PEDro scale to assess the methodological quality of clinical trials. PEDro summary scores should not be used; rather, the physiotherapy community should consider working with the individual items of the scale.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,533
score de la tête « metaresearch » (Gemma)0,770
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche
Catégories consensuellesMétarecherche
DomaineSignal candidat: Méthodes · Signal consensuel: Méthodes
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,467
Score d'incertitude au seuil0,575

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,5330,770
Méta-épidémiologie (sens strict)0,0010,001
Méta-épidémiologie (sens large)0,0070,018
Bibliométrie0,0160,017
Études des sciences et des technologies0,0010,006
Communication savante0,0070,005
Science ouverte0,0030,007
Intégrité de la recherche0,0020,004
Charge utile insuffisante (le modèle a refusé de juger)0,0030,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,943
Tête enseignante GPT0,760
Écart entre enseignants0,183 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; l’étiquette directe de Gemma et le classifieur distillé Codex s’accordent sur ce qui est montré ici.

Devis d'étudeObservationnel
DomaineMéthodes
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations77
Publié2019
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueResearch Synthesis MethodsMême sujetPsychometric Methodologies and TestingTravaux en français237 207