MétaCan
Menu
Retour à la cohorte
Enregistrement W4411150076 · doi:10.1158/2159-8290.cd-24-1488

Federated Deep Learning Enables Cancer Subtyping by Proteomics

2025· article· en· W4411150076 sur OpenAlexafffund
Zhaoxiang Cai, Emma L. Boys, Zainab Noor, Adel T. Aref, Dylan Xavier, Natasha Lucas, Steven G. Williams, Jennifer M.S. Koh, Rebecca C. Poulos, Yangxiu Wu, Michael Dausmann, Karen L. MacKenzie, Adriana Aguilar‐Mahecha, Carolina Armengol, Maria M. Barranco, Mark Basik, Elise D. Bowman, Roderick Clifton‐Bligh, Elizabeth A. Connolly, Wendy A. Cooper, Bhavik Dalal, Anna DeFazio, Martin Filipits, Peter Flynn, J. Dinny Graham, Jacob George, Anthony J. Gill, Michael Gnant, Rosemary Habib, Curtis C. Harris, Kate Harvey, Lisa G. Horvath, Christopher C. Jackson, Maija R.J. Kohonen‐Corish, Elgene Lim, Jia Liu, Georgina V. Long, Reginald V. Lord, Graham J. Mann, Geoffrey W. McCaughan, Lucy Morgan, Leigh C. Murphy, Sumanth Nagabushan, Adnan Nagrial, Jordi Navinés, Benedict Panizza, Jaswinder S. Samra, Richard A. Scolyer, John Souglakos, Alexander Swarbrick, David M. Thomas, Rosemary L. Balleine, Peter G. Hains, Phillip J. Robinson, Qing Zhong, Roger R. Reddel

Notice bibliographique

RevueCancer Discovery · 2025
Typearticle
Langueen
DomaineChemistry
ThématiqueAdvanced Proteomics Techniques and Applications
Établissements canadiensUniversity of ManitobaResearch Institute in Oncology and HematologyMcGill UniversityCancerCare ManitobaJewish General Hospital
Organismes subventionnairesNational Cancer InstituteAgència de Gestió d'Ajuts Universitaris i de RecercaCancer Council VictoriaCancer Council NSWNational Health and Medical Research CouncilHorizon 2020 Framework ProgrammeCRIS Cancer FoundationMedical Research CouncilNSW Ministry of HealthCancer Institute NSWUniversity of SydneyAustralian Cancer Research FoundationState Government of VictoriaEuropean CommissionFondation du cancer du sein du QuébecChildren's Medical ResearchNational Breast Cancer FoundationDavid and Elaine Potter FoundationAstraZenecaTour de CureU.S. Department of Health and Human Services
Mots-clésComputer scienceGeneralizability theorySubtypingReplicateBiomedicineMachine learningArtificial intelligenceMatching (statistics)Data miningBioinformaticsMedicineBiology

Résumé

récupéré en direct d'OpenAlex

Artificial intelligence applications in biomedicine face major challenges from data privacy requirements. To address this issue for clinically annotated tissue proteomic data, we developed a federated deep learning approach (ProCanFDL), training local models on simulated sites containing data from a pan-cancer cohort (n = 1,260) and 29 cohorts held behind private firewalls (n = 6,265), representing 19,930 replicate data-independent acquisition mass spectrometry runs. Local parameter updates were aggregated to build the global model, achieving a 43% performance gain on the hold-out test set (n = 625) in 14 cancer subtyping tasks compared with local models and matching centralized model performance. The approach's generalizability was demonstrated by retraining the global model with data from two external, data-independent acquisition mass spectrometry cohorts (n = 55) and eight acquired by tandem mass tag proteomics (n = 832). ProCanFDL presents a solution for internationally collaborative machine learning initiatives using proteomic data, for example, for discovering predictive biomarkers or treatment targets while maintaining data privacy. SIGNIFICANCE: A federated deep learning approach applied to human proteomic data, acquired using two distinct proteomic technologies from 40 tumor cohorts across eight countries, enabled accurate cancer histopathologic subtyping while preserving data privacy. This approach will enable the privacy-compliant development of large-scale proteomic artificial intelligence models, including foundation models, across institutions globally.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction distillée sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.

score de la tête « metaresearch » (Codex)0,000
score de la tête « metaresearch » (Gemma)0,000
Version: codex-gemma-dda1882f352aStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Expérimental (laboratoire) · Signal consensuel: Expérimental (laboratoire)
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,392
Score d'incertitude au seuil0,802

Scores Codex et Gemma par catégorie

CatégorieCodexGemma
Métarecherche0,0000,000
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0000,000
Études des sciences et des technologies0,0000,000
Communication savante0,0000,000
Science ouverte0,0000,000
Intégrité de la recherche0,0000,000
Charge utile insuffisante (le modèle a refusé de juger)0,0000,000

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,008
Tête enseignante GPT0,284
Écart entre enseignants0,275 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeExpérimental (laboratoire)
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations11
Publié2025
Routes d'admission2
Résumé présentoui

Explorer davantage

Même revueCancer DiscoveryMême sujetAdvanced Proteomics Techniques and ApplicationsTravaux en français237 207