Expert Delphi Consensus on Surrogate Endpoints for Treatment Assessment in Metabolic Dysfunction-associated Steatohepatitis
Notice bibliographique
Résumé
BACKGROUND & AIMS: The growing burden of metabolic dysfunction-associated steatohepatitis (MASH) and the urgency for effective therapies have driven the adoption of surrogate endpoints for treatment evaluation. Consensus on the most appropriate measures for regulatory approval, clinical practice, or reimbursement remains limited. This study aimed to establish expert consensus on appropriate surrogate endpoints and potential surrogate outcome measures in MASH. METHODS: A modified Delphi process was conducted with 23 international experts across hepatology, gastroenterology, and others. A targeted literature review informed 2 structured survey rounds. Round 1 addressed measures relevant to establishing efficacy/effectiveness for reimbursement; Round 2 explored their application for monitoring treatment effectiveness in clinical practice. Consensus was defined as ≥75% agreement, and strong consensus as ≥95%. The process was conducted and reported in accordance with established frameworks, including Conducting and REporting DElphi Studies (CREDES). RESULTS: Histological endpoints-specifically, ≥1-stage fibrosis improvement without MASH worsening, and MASH resolution without fibrosis worsening-were considered appropriate for regulatory/reimbursement settings, mostly owing to current regulatory guidelines. In clinical practice, noninvasive tests (NITs) were preferred. There was consensus that a ≥30% reduction in liver stiffness measurement (LSM) assessed via vibration-controlled transient elastography (VCTE) or magnetic resonance elastography (MRE) is a meaningful indicator of treatment response and reasonably likely translates to improved long-term outcome benefit. Consensus also supported replacing liver biopsy with NITs in practice. CONCLUSIONS: This international Delphi study highlights histological and NIT-based measures as key for MASH treatment evaluation. It also supports a shift toward NITs-particularly LSM by VCTE or MRE-for disease monitoring in routine practice, with implications for trial design, reimbursement, and clinical guidelines.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,420 | 0,423 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,001 |
| Méta-épidémiologie (sens large) | 0,004 | 0,008 |
| Bibliométrie | 0,004 | 0,003 |
| Études des sciences et des technologies | 0,004 | 0,005 |
| Communication savante | 0,008 | 0,005 |
| Science ouverte | 0,004 | 0,013 |
| Intégrité de la recherche | 0,006 | 0,013 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,006 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».