MétaCan
Menu
Retour à la cohorte
Enregistrement W2000477303 · doi:10.1097/acm.0b013e3181637925

The Reported Validity and Reliability of Methods for Evaluating Continuing Medical Education: A Systematic Review

2008· review· en· W2000477303 sur OpenAlexaboutno aff
Neda Ratanawongsa, Patricia A. Thomas, Spyridon S Marinopoulos, Todd Dorman, Lisa M Wilson, Bimal H. Ashar, Jeffrey Magaziner, Redonda G. Miller, Gregory Prokopowicz, Rehan Qayyum, Eric B Bass

Notice bibliographique

RevueAcademic Medicine · 2008
Typereview
Langueen
DomaineMedicine
ThématiqueInnovations in Medical Education
Établissements canadiensnon disponible
Organismes subventionnairesJohns Hopkins University
Mots-clésReliability (semiconductor)Medical educationMEDLINEValidityContinuing medical educationPsychologyContinuing educationMedicineClinical psychologyPsychometricsPolitical science

Résumé

récupéré en direct d'OpenAlex

PURPOSE: To appraise the reported validity and reliability of evaluation methods used in high-quality trials of continuing medical education (CME). METHOD: The authors conducted a systematic review (1981 to February 2006) by hand-searching key journals and searching electronic databases. Eligible articles studied CME effectiveness using randomized controlled trials or historic/concurrent comparison designs, were conducted in the United States or Canada, were written in English, and involved at least 15 physicians. Sequential double review was conducted for data abstraction, using a traditional approach to validity and reliability. RESULTS: Of 136 eligible articles, 47 (34.6%) reported the validity or reliability of at least one evaluation method, for a total of 62 methods; 31 methods were drawn from previous sources. The most common targeted outcome was practice behavior (21 methods). Validity was reported for 31 evaluation methods, including content (16), concurrent criterion (8), predictive criterion (1), and construct (5) validity. Reliability was reported for 44 evaluation methods, including internal consistency (20), interrater (16), intrarater (2), equivalence (4), and test-retest (5) reliability. When reported, statistical tests yielded modest evidence of validity and reliability. Translated to the contemporary classification approach, our data indicate that reporting about internal structure validity exceeded reporting about other categories of validity evidence. CONCLUSIONS: The evidence for CME effectiveness is limited by weaknesses in the reported validity and reliability of evaluation methods. Educators should devote more attention to the development and reporting of high-quality CME evaluation methods and to emerging guidelines for establishing the validity of CME evaluation methods.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,033
score de la tête « metaresearch » (Gemma)0,450
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesMétarecherche, Méta-épidémiologie (sens strict)
Catégories consensuellesMétarecherche
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Revue systématique · Signal consensuel: Revue systématique
GenreSignal candidat: Synthèse · Signal consensuel: Synthèse
Score de désaccord entre enseignants0,439
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0330,450
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0050,000
Bibliométrie0,0000,001
Études des sciences et des technologies0,0000,001
Communication savante0,0000,000
Science ouverte0,0010,000
Intégrité de la recherche0,0010,002
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,224
Tête enseignante GPT0,594
Écart entre enseignants0,370 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeRevue systématique
Domainenon disponible
GenreSynthèse

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations69
Publié2008
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueAcademic MedicineMême sujetInnovations in Medical EducationTravaux en français237 207