MétaCan
Menu
Retour à la cohorte
Enregistrement W4390993543 · doi:10.1109/biocas58349.2023.10388714

Automatic Post-Traumatic Stress Disorder Diagnosis via Clinical Transcripts: A Novel Text Augmentation with Large Language Models

2023· article· en· W4390993543 sur OpenAlexaff
Yuqi Wu, Jie Chen, Kaining Mao, Yanbo Zhang

Notice bibliographique

Revuenon disponible
Typearticle
Langueen
DomainePsychology
ThématiqueMental Health via Writing
Établissements canadiensUniversity of Alberta
Organismes subventionnairesnon disponible
Mots-clésLeverage (statistics)Computer scienceArtificial intelligenceMachine learningNatural language processingTraumatic stressSupport vector machineDistressPsychologyClinical psychology

Résumé

récupéré en direct d'OpenAlex

Post-traumatic stress disorder (PTSD) is one of the predominant mental disorders in the world. With the development of machine learning (ML), more people have started using natural language processing (NLP) models to make early mental disorder diagnoses, including PTSD. However, these NLP tasks often suffer from data imbalance issues due to the data collection difficulty. Therefore, the current study proposed two novel text augmentation frameworks to cope with data imbalance issues for clinical NLP tasks by leveraging Large Language Models (LLMs). The proposed frameworks utilize two distinct methodologies to augment the original dataset, thereby extending the publicly available Extended Distress Analysis Interview Corpus (E-DAIC) for PTSD. These methodologies involve generating standardized transcripts of PTSD interviews through a zero-shot (ZS) approach and rephrasing the existing training samples in the dataset via a few-shot (FS) approach. The FS and ZS augmented datasets outperform the original EDAIC dataset in automatic PTSD diagnosis. The ZS dataset, with GPT embeddings, achieves the highest performance, demonstrating the potential of LLMs to generate authentic clinical interviews and resolve data imbalance. Despite the FS approach performing slightly inferior to ZS, it still surpasses the original dataset with fewer samples and simplified prompts. The augmented dataset maintains high similarity to the original EDAIC dataset. This research has significant implications, enabling individual ML researchers to leverage powerful LLMs for innovative applications, reducing labour and time costs. LLMs can generate synthetic data at a fraction of the expense of recruiting human volunteers, facilitating future clinical NLP tasks. The approach offers flexibility in generating realistic and professional content through prompt design.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesCharge utile insuffisante (le modèle a refusé de juger)
Catégories consensuellesCharge utile insuffisante (le modèle a refusé de juger)
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,401
Score d'incertitude au seuil1,000

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,001
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0040,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,074
Tête enseignante GPT0,418
Écart entre enseignants0,344 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.

Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations10
Publié2023
Routes d'admission1
Résumé présentoui

Explorer davantage

Même sujetMental Health via WritingTravaux en français237 207