Reproducibility of the Histological Diagnosis of Cervical Dysplasia Among Pathologists From 4 Continents
Notice bibliographique
Résumé
The reliable histological diagnosis of cervical squamous intraepithelial lesions (SILs), especially low-grade SIL, is known to be problematic. Poor diagnostic reproducibility can complicate studies addressing its appropriate management. As part of an international study comparing expectant management of histologically proven low-grade SIL with immediate loop electrocautery excisional procedure, this study was carried out to assess interobserver agreement on the histological diagnosis of SILs among a group of 22 pathologists from 5 countries and the intraobserver reliability among a subset of 7 Canadian pathologists. Fifty-six histological slides from colposcopically obtained cervical biopsies were circulated to each of the 22 pathologists. To assess intraobserver reliability, 7 Canadian pathologists assessed 40 of the slides once and 16 of the slides twice. Kappa values were used to measure interobserver agreement with an overall kappa value of 0.61 (95% confidence interval, 0.60-0.62) corresponding to moderate reliability. The weighted kappa values for interobserver agreement ranged from 0.46 to 0.88 (median, 0.79). The intraobserver reliability of 7 Canadian pathologists ranged from substantial to excellent based upon the weighted kappa values ranging from 0.62 to 0.94 (median, 0.72). This degree of reliability is comparable to that found in similar studies. In an individual case, there can be considerable disparity in diagnosis that can result in disparate management strategies. This adds a layer of complexity to any trial that attempts to assess optimal treatment strategies or the natural history of this disease.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,015 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,002 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,001 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».