MétaCan
Menu
Retour à la cohorte
Enregistrement W4407085131 · doi:10.1016/j.compbiomed.2025.109735

S4Sleep: Elucidating the design space of deep-learning-based sleep stage classification models

2025· article· en· W4407085131 sur OpenAlexaboutno aff
Tiezhi Wang, Nils Strodthoff

Notice bibliographique

RevueComputers in Biology and Medicine · 2025
Typearticle
Langueen
DomaineNeuroscience
ThématiqueEEG and Brain-Computer Interfaces
Établissements canadiensnon disponible
Organismes subventionnairesnon disponible
Mots-clésComputer scienceArtificial intelligenceSleep (system call)Stage (stratigraphy)Space (punctuation)Machine learningDeep learningBiologyOperating system

Résumé

récupéré en direct d'OpenAlex

Machine-learning-based automatic sleep stage scoring is a promising approach to enhance the time-consuming manual annotation process of polysomnography recordings. Although numerous algorithms have been proposed for this purpose, systematic exploration of architectural design decisions remains limited. This study conducts a comprehensive investigation into these design choices within the broad category of encoder–predictor architectures. The methodology identifies robust architectures applicable to both time series and spectrogram input representations, both of which leverage structured state space models as integral components. Without further hyperparameter adjustments, the proposed models S4Sleep(spec) and S4Sleep(ts) consistently surpass all existing approaches on the most commonly used benchmark datasets: Sleep EDF, the Montreal Archive of Sleep Studies, and, most notably, the extensive Sleep Heart Health Study dataset. The architectural insights derived from this research, along with the refined methodology for architecture search demonstrated herein, are expected to not only advance future research in sleep staging but also be beneficial for other time series annotation tasks. • Developed systematic method for finding optimal time series annotation architectures. • Identified encoder–predictor models with S4 as best performing architecture. • Demonstrated strong performance using both raw time series and spectrogram inputs. • Validated S4’s effectiveness as signal encoder for both input representations. • Surpassed benchmarks on three major sleep datasets (Sleep EDF, MASS, SHHS).

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,001
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Simulation ou modélisation · Signal consensuel: aucune
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,898
Score d'incertitude au seuil0,279

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0010,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,001
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,052
Tête enseignante GPT0,329
Écart entre enseignants0,277 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeSimulation ou modélisation
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations7
Publié2025
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueComputers in Biology and MedicineMême sujetEEG and Brain-Computer InterfacesTravaux en français237 207