MétaCan
Menu
Retour à la cohorte
Enregistrement W4408260879 · doi:10.1016/j.ab.2025.115828

DHUpredET: A comparative computational approach for identification of dihydrouridine modification sites in RNA sequence

2025· article· en· W4408260879 sur OpenAlexafffund
Md. Fahim Sultan, Tasmin Karim, Md. Shazzad Hossain Shaon, Sayed Mehedi Azim, Abdollah Dehzangi, Mst Shapna Akter, Sobhy M. Ibrahim, Md. Mamun Ali, Kawsar Ahmed, Francis M. Bui

Notice bibliographique

RevueAnalytical Biochemistry · 2025
Typearticle
Langueen
DomaineBiochemistry, Genetics and Molecular Biology
ThématiqueRNA modifications and cancer
Établissements canadiensUniversity of Saskatchewan
Organismes subventionnairesNatural Sciences and Engineering Research Council of CanadaKing Saud University
Mots-clésSequence (biology)Identification (biology)Computational biologyRNAComputer scienceBiologyBiochemistryEcologyGene

Résumé

récupéré en direct d'OpenAlex

Laboratory-based detection of D sites is laborious and expensive. In this study, we developed effective machine learning models employing efficient feature encoding methods to identify D sites. Initially, we explored various state-of-the-art feature encoding approaches and 30 machine learning techniques for each and selected the top eight models based on their independent testing and cross-validation outcomes. Finally, we developed DHUpredET using the extra tree classifier methods for predicting DHU sites. The DHUpredET model demonstrated balanced performance across all evaluation criteria, outperforming state-of-the-art models by 8% and 14% in terms of accuracy and sensitivity, respectively, on an independent test set. Further analysis revealed that the model achieved higher accuracy with position-specific two nucleotide (PS2) features, leading us to conclude that PS2 features are the best suited for the DHUpredET model. Therefore, our proposed model emerges as the most favorite choice for predicting D sites. In addition, we conducted an in-depth analysis of local features and identified a particularly significant attribute with a feature score of 0.035 for PS2_299 attributes. This tool holds immense promise as an advantageous instrument for accelerating the discovery of D modification sites, which contributes too many targeting therapeutic and understanding RNA structure. • Executed an in-depth analysis employing various machine learning techniques. • Uncovered the most informative features and optimal machine-learning algorithms for predicting D sites in RNA sequences. • Proposed DHUpredET, a machine learning-based method than can significantly outperform previous studies found in the literature. • Exceled at leveraging position-specific two nucleotides (PS2) features with appropriate execution. • Identified the positive class with greater than 85% and specified the negative class with more than 82% accuracy, which produces a balance outcome.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,000
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Expérimental (laboratoire) · Signal consensuel: Expérimental (laboratoire)
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,217
Score d'incertitude au seuil0,459

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0000,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,044
Tête enseignante GPT0,353
Écart entre enseignants0,310 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeExpérimental (laboratoire)
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations4
Publié2025
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueAnalytical BiochemistryMême sujetRNA modifications and cancerTravaux en français237 207