MétaCan
Menu
Retour à la cohorte
Enregistrement W2135146202 · doi:10.1186/1471-2288-12-187

Systematic reviews need to consider applicability to disadvantaged populations: inter-rater agreement for a health equity plausibility algorithm

2012· article· en· W2135146202 sur OpenAlexafffund
Vivian Welch, Kevin Brand, Elizabeth Kristjansson, Janet Smylie, George A. Wells, Peter Tugwell

Notice bibliographique

RevueBMC Medical Research Methodology · 2012
Typearticle
Langueen
DomaineDecision Sciences
ThématiqueMeta-analysis and systematic reviews
Établissements canadiensPublic Health OntarioSt. Michael's HospitalUniversity of TorontoInstitute of Population and Public HealthOttawa HospitalUniversity of Ottawa
Organismes subventionnairesCanadian Institutes of Health ResearchUniversity of Ottawa
Mots-clésConfidence intervalSocioeconomic statusMedicineSystematic reviewDisadvantagedPsychological interventionMeta-analysisKappaInter-rater reliabilityPopulationCredibilityMEDLINEDemographyStatisticsEnvironmental healthMathematicsPsychiatryPathology

Résumé

récupéré en direct d'OpenAlex

BACKGROUND: Systematic reviews have been challenged to consider effects on disadvantaged groups. A priori specification of subgroup analyses is recommended to increase the credibility of these analyses. This study aimed to develop and assess inter-rater agreement for an algorithm for systematic review authors to predict whether differences in effect measures are likely for disadvantaged populations relative to advantaged populations (only relative effect measures were addressed). METHODS: A health equity plausibility algorithm was developed using clinimetric methods with three items based on literature review, key informant interviews and methodology studies. The three items dealt with the plausibility of differences in relative effects across sex or socioeconomic status (SES) due to: 1) patient characteristics; 2) intervention delivery (i.e., implementation); and 3) comparators. Thirty-five respondents (consisting of clinicians, methodologists and research users) assessed the likelihood of differences across sex and SES for ten systematic reviews with these questions. We assessed inter-rater reliability using Fleiss multi-rater kappa. RESULTS: The proportion agreement was 66% for patient characteristics (95% confidence interval: 61%-71%), 67% for intervention delivery (95% confidence interval: 62% to 72%) and 55% for the comparator (95% confidence interval: 50% to 60%). Inter-rater kappa, assessed with Fleiss kappa, ranged from 0 to 0.199, representing very low agreement beyond chance. CONCLUSIONS: Users of systematic reviews rated that important differences in relative effects across sex and socioeconomic status were plausible for a range of individual and population-level interventions. However, there was very low inter-rater agreement for these assessments. There is an unmet need for discussion of plausibility of differential effects in systematic reviews. Increased consideration of external validity and applicability to different populations and settings is warranted in systematic reviews to meet this need.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,878
score de la tête « metaresearch » (Gemma)0,906
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Charge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesMétarecherche, Charge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: Méthodes · Signal consensuel: Méthodes
Devis d'étudeSignal candidat: Sans objet · Signal consensuel: aucune
GenreSignal candidat: Méthodes · Signal consensuel: Méthodes
Score de désaccord entre enseignants0,533
Score d'incertitude au seuil0,995

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,8780,906
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0090,002
Bibliométrie0,0010,003
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0030,002
Intégrité de la recherche0,0000,001
Charge utile insuffisante (le modèle a refusé de juger)0,0110,005

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,981
Tête enseignante GPT0,781
Écart entre enseignants0,199 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeSans objet
DomaineMéthodes
GenreMéthodes

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations24
Publié2012
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueBMC Medical Research MethodologyMême sujetMeta-analysis and systematic reviewsTravaux en français237 207