Automated structural assignment of derivatized complex N‐linked oligosaccharides from tandem mass spectra
Notice bibliographique
Résumé
Glycoprotein function is controlled by several biological factors, one of them being the structure of carbohydrate chains (glycans) attached to specific amino acids of the protein backbone. Changes in glycan structures have been shown to modify the secondary and tertiary conformation of glycoproteins, thus their function. Powerful analytical tools are available for the characterization of sugar structures, and recently mass spectrometry (MS) has been increasingly useful for this purpose. Manual interpretation of tandem mass spectrum is possible but tedious. Automated interpretation should speed the analysis and enhance the results obtained. A new computer program for automated interpretation of tandem MS spectra of complex N-linked glycans oligosaccharides from mammals will be described. N-Linked oligosaccharides standards were derivatized with 1-phenyl-3-methyl-5-pyrazolone (PMP) and analyzed by matrix-assisted laser desorption/ionization (MALDI)-tandem MS. Simulated tandem mass spectra of other common glycans were also generated to test the algorithm. The MALDI-MS/MS spectra featured resolved isotopic distributions for the [M + H](+) and fragment ions of oligosaccharides. These isotopic distributions complicated the automated analysis of the spectra and were removed to leave only monoisotopic peaks. An algorithm was written for this purpose, yielding simplified tandem mass spectra. Another algorithm is then used to determine the structure of the oligosaccharide. A score is then given to each structure, depending on agreement with experimental results. The program successfully assigned the true structure in 24 out of the 28 cases (86%) and the true structure was among the three top scoring structures in all cases.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,000 | 0,001 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,001 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,002 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».