SeqDA-HLA: Language Model and Dual Attention-Based Network to Predict Peptide-HLA Class I Binding
Notice bibliographique
Résumé
Accurate prediction of peptide-HLA class I binding is crucial for immunotherapy and vaccine development, but existing methods often struggle to capture the intricate biological relationships between peptides and diverse HLA alleles. Here, we introduce SeqDA-HLA, a pan-specific prediction model that combines language model-based embeddings (ELMo) with a dual attention mechanism-self-aligned cross-attention and self-attention-to capture rich contextual features and pairwise interactions. Evaluations against 14 state-of-the-art methods on multiple benchmark datasets demonstrate that SeqDA-HLA consistently outperforms competing approaches, achieving an AUC value up to 0.9856 and accuracy as high as 0.9408. Notably, SeqDA-HLA maintains robust performance across peptide lengths (8-14) and HLA alleles, showcasing its generalizability. Beyond predictive accuracy, SeqDA-HLA offers interpretability by highlighting essential anchor residues and revealing key binding motifs, thereby aligning with experimentally validated biological insights. As a further demonstration of practical impact, we fine-tune SeqDA-HLA on an Influenza virus dataset, successfully predicting binding changes induced by single amino acid mutations. Overall, SeqDA-HLA serves as a powerful and interpretable tool for peptide-HLA binding prediction, with potential applications in epitope-based vaccine design and precision immunotherapy.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».