Deep Learning Algorithms to Detect Murmurs Associated With Structural Heart Disease
Notice bibliographique
Résumé
Background The success of cardiac auscultation varies widely among medical professionals, which can lead to missed treatments for structural heart disease. Applying machine learning to cardiac auscultation could address this problem, but despite recent interest, few algorithms have been brought to clinical practice. We evaluated a novel suite of Food and Drug Administration-cleared algorithms trained via deep learning on >15 000 heart sound recordings. Methods and Results We validated the algorithms on a data set of 2375 recordings from 615 unique subjects. This data set was collected in real clinical environments using commercially available digital stethoscopes, annotated by board-certified cardiologists, and paired with echocardiograms as the gold standard. To model the algorithm in clinical practice, we compared its performance against 10 clinicians on a subset of the validation database. Our algorithm reliably detected structural murmurs with a sensitivity of 85.6% and specificity of 84.4%. When limiting the analysis to clearly audible murmurs in adults, performance improved to a sensitivity of 97.9% and specificity of 90.6%. The algorithm also reported timing within the cardiac cycle, differentiating between systolic and diastolic murmurs. Despite optimizing acoustics for the clinicians, the algorithm substantially outperformed the clinicians (average clinician accuracy, 77.9%; algorithm accuracy, 84.7%.) Conclusions The algorithms accurately identified murmurs associated with structural heart disease. Our results illustrate a marked contrast between the consistency of the algorithm and the substantial interobserver variability of clinicians. Our results suggest that adopting machine learning algorithms into clinical practice could improve the detection of structural heart disease to facilitate patient care.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,002 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,002 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».