Artifacts for "CPU- and GPU-initiated Communication Strategies for Conjugate Gradient Methods on Large GPU Clusters"
Notice bibliographique
Résumé
This dataset contains computational artifacts related to the paper: “CPU- and GPU-initiated Communication Strategies for Conjugate Gradient Methods on Large GPU Clusters” The paper describes computational experiments that were conducted to evaluate the performance of multi-GPU iterative linear solvers based on the conjugate gradient (CG) method. The computational artifacts are located in several subdirectories: 'aCG-1.0.0/' contains the source code for aCG (version 1.0.0), which implements of the various multi-GPU CG solvers that are used for the performance benchmarks presented in the paper. 'partitions/' contains input files related to partitioning and distributing matrices that were used in the experiments. Partitions were computed using METIS (Karypis and Kumar, 1998), a multilevel graph partitioner. From the SuiteSparse Collection (Davis and Hu, 2011), six matrices were selected: Bump_2911, Cube_Coup_dt6, Flan_1565, Queen_4147, Serena and audikw_1. For each matrix, partitions are provided for 2, 4, 8, 16 and 32 parts. 'scripts/' contains job scripts for submitting jobs on three clusters: LUMI, MareNostrum 5 and Wisteria/BDEC-01 (Aquarius). These scripts carry out performance measurements for the multi-GPU CG solvers in aCG and PETSc, and were used to collect the results presented in the paper. 'results/' contains results from the performance benchmarks presented in the paper as tables in a plain-text format. References Davis, T. A. and Y. Hu. 2011. “The University of Florida Sparse Matrix Collection”. ACM Transactions on Mathematical Software 38, 1, Article 1 (December 2011), 25 pages. DOI: https://doi.org/10.1145/2049662.2049663 Karypis, G., and V. Kumar. 1998. “A fast and high quality multilevel scheme for partitioning irregular graphs”. SIAM Journal on scientific Computing 20, 1, pp. 359–392. DOI: https://doi.org/10.1137/S1064827595287997
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,011 |
| Méta-épidémiologie (sens strict) | 0,003 | 0,001 |
| Méta-épidémiologie (sens large) | 0,002 | 0,002 |
| Bibliométrie | 0,003 | 0,007 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,004 | 0,003 |
| Intégrité de la recherche | 0,002 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,088 | 0,047 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».