Comparative Performance of 2018 <scp>LI‐RADS</scp> versus Modified <scp>LIRADS</scp> (<scp>mLI‐RADS</scp>): An Individual Participant Data Meta‐Analysis
Notice bibliographique
Résumé
BACKGROUND: LI-RADS version 2018 (v2018) is used for non-invasive diagnosis of hepatocellular carcinoma (HCC). A recently proposed modification (known as mLI-RADS) demonstrated improved sensitivity while maintaining specificity and positive predictive value (PPV) of LI-RADS category 5 (definite HCC) for HCC. However, mLI-RADS requires multicenter validation. PURPOSE: To evaluate the performance of v2018 and mLI-RADS for liver lesions in a large, heterogeneous, multi-national cohort of patients at risk for HCC. STUDY TYPE: Systematic review and meta-analysis using individual participant data (IPD) [Study Protocol: https://osf.io/duys4]. POPULATION: 2223 observations from 1817 patients (includes all LI-RADS categories; females = 448, males = 1361, not reported = 8) at elevated risk for developing HCC (based on LI-RADS population criteria) from 12 retrospective studies. FIELD STRENGTH/SEQUENCE: 1.5T and 3T; complete liver MRI with gadoxetate disodium, including axial T2w images and dynamic axial fat-suppressed T1w images precontrast and in the arterial, portal venous, transitional, and hepatobiliary phases. Diffusion-weighted imaging was used when available. ASSESSMENT: Liver observations were categorized using v2018 and mLI-RADS. The diagnostic performance of each system's category 5 (LR-5 and mLR-5) for HCC were compared. STATISTICAL TESTS: The Quality Assessment of Diagnostic Accuracy Studies version 2 (QUADAS-2 was applied to determine risk of bias and applicability. Diagnostic performances were assessed using the likelihood ratio test for sensitivity and specificity and the Wald test for PPV. The significance level was P < 0.05. RESULTS: 17% (2/12) of the studies were considered low risk of bias (244 liver observations; 164 patients). When compared to v2018, mLR-5 demonstrated higher sensitivity (61.3% vs. 46.5%, P < 0.001), similar PPV (85.3% vs. 86.3%, P = 0.89), and similar specificity (85.8% vs. 90.8%, P = 0.16) for HCC. DATA CONCLUSION: This study confirms mLR-5 has higher sensitivity than LR-5 for HCC identification, while maintaining similar PPV and specificity, validating the mLI-RADS proposal in a heterogeneous, international cohort. LEVEL OF EVIDENCE: 3 TECHNICAL EFFICACY: Stage 2.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,013 | 0,025 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,001 |
| Méta-épidémiologie (sens large) | 0,011 | 0,036 |
| Bibliométrie | 0,002 | 0,003 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,003 | 0,002 |
| Science ouverte | 0,002 | 0,001 |
| Intégrité de la recherche | 0,002 | 0,002 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».