Validity, reliability and responsiveness of the Brazilian version of the Western Ontario Rotator Cuff Index
Bibliographic record
Abstract
Objetivo: Avaliar a validade, confiabilidade e responsividade da versão brasileira do questionário WORC. Métodos: Para testar a validade concorrente, 100 pacientes com enfermidades do manguito rotador foram avaliados usando o WORC, desfechos clinicamente relevantes para avaliação de ombro (dor, amplitude de movimento e força muscular) e os instrumentos DASH, SF-36 e UCLA. O WORC foi repetido a 50 pacientes no mesmo dia e após uma média de intervalo de 7 dias para avaliar a reprodutibilidade (teste/reteste). Para testar a responsividade, o WORC, DASH, UCLA e SF-36 foram administrados à uma amostra de 30 pacientes na avaliação inicial e três meses após o tratamento recomendado (fisioterapia ou tratamento cirúrgico) e foi dividida em dois grupos: pacientes com melhora após o tratamento (n=20) e os que não melhoraram (n=10), de acordo com a estratégia baseada em âncoras. A validade concorrente foi testada através do Coeficiente de correlação de Person. A reprodutibilidade e consistência interna foram analisadas pelo Coeficiente de correlação intraclasses e alpha de Cronbach, respectivamente. As pontuações foram usadas para avaliar o erro padrão de medida (do inglês, SEM) e a mudança mínima detectável (do inglês, MDC). O tamanho do efeito (do inglês, ES) e média da resposta padrão (do inglês, SRM) foram calculados para responsividade. Resultados: A análise entre o WORC e os desfechos clinicamente relevantes revelaram correlações de fraca a forte, sendo a mais fraca para amplitude de movimento de rotação medial (r=-0,22) e a mais forte para dor ao movimento (r=- 0,75). Correlações fortes também foram encontradas com o DASH e UCLA (r=-0,86 and r=-0,80, respectivamente) e correlações moderadas com os domínios do SF-36 (0,37 a 0,69), sendo as maiores relacionadas aos domínios físicos. A análise da confiabilidade demonstrou resultados considerados excelentes, com coeficiente de correlação intraclasses e alpha de Cronbach variando de 0,88 a 0,99. O SEM foi de 5,2 e 3,0 pontos para a avaliação inicial e após o intervalo médio de 7 dias, respectivamente. O MDC foi de 7,1 pontos (90% intervalo de confiança). Analisando a responsividade, todos os instrumentos mostraram valores mais altos de ES e SRM para o grupo “melhorou” que no grupo “não melhorou”. O WORC demonstrou valores de moderados a altos (0,66 to 1,1) para o grupo “melhorou”. O mesmo ocorreu com o DASH e UCLA. Os valores do SF-36 variaram de pequeno a grande e o valor mais alto foi para o domínio aspectos físicos no mesmo grupo. Conclusões: A versão brasileira do WORC mostrou ser uma medida válida e confiável. O WORC, assim como o UCLA, DASH e domínios físicos do SF-36 mostraram ser instrumentos responsivos após curto período de prosseguimento de tratamento para enfermidades do manguito rotador
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.012 | 0.060 |
| Meta-epidemiology (narrow) | 0.001 | 0.000 |
| Meta-epidemiology (broad) | 0.001 | 0.001 |
| Bibliometrics | 0.002 | 0.002 |
| Science and technology studies | 0.001 | 0.001 |
| Scholarly communication | 0.001 | 0.001 |
| Open science | 0.001 | 0.001 |
| Research integrity | 0.001 | 0.000 |
| Insufficient payload (model declined to judge) | 0.001 | 0.000 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".