MétaCan
Menu
Retour à la cohorte
Enregistrement W4285337568 · doi:10.1109/insai54028.2021.00041

TIAS: Two-level Information-Agnostic Job Scheduling in GPU Clusters

2021· article· en· W4285337568 sur OpenAlexaff
Kun Yang, Jieyu Lin, Wei Ni, Liang Song

Notice bibliographique

Revuenon disponible
Typearticle
Langueen
DomaineComputer Science
ThématiqueDistributed and Parallel Computing Systems
Établissements canadiensUniversity of Toronto
Organismes subventionnairesnon disponible
Mots-clésComputer scienceScheduling (production processes)Processor schedulingParallel computingGPU clusterJob schedulerCUDAOperating systemMathematical optimizationCloud computingMathematics

Résumé

In recent years, deep learning algorithms have shown a trend towards larger models and larger datasets. Centralized training is unable keep up with the training requirements due to limited storage and computing resources, thus distributed learning is becoming an important area of research for improving learning efficiency. There are many studies on using the features of deep learning workload to design a central scheduler for production clusters.While existing work has been focusing on overall completion time and resource efficiency, little attention has been paid to the execution deadlines. To achieve a balance between the goals of deadline and non-deadline jobs, we design a Two-level Information-Agnostic Scheduling strategy(TIAS), which can schedule the two kinds of jobs together without knowing jobs’ training duration. In the first level, we use different priority calculation methods for the two kinds of jobs; in the second level, we design a new indicator "queue urgency" based on three observations to sort deadline jobs within the same queue. Experiments on a trace-driven simulator prove that TIAS can achieve the best trade-off between deadline miss rate and non-deadline jobs’ average job completion time(JCT) compared to existing solutions.

Conservé avec la notice de tri, où il sert de preuve aux étiquettes ci-dessus.

Comment cette classification a été obtenuedéplier

Le tri à trois modèles

les 5 600 travaux triés →

Les trois modèles l'ont jugé hors champ.

strate : aff_core · poids de sondage : 5595.24 (l'échantillon est stratifié ; tout taux calculé sans le poids est faux)
Claude Opus 4.8OUT
genre : empirical
porte sur le Canada: non
confiance: high

GPU cluster job scheduling algorithm for deep learning workloads; a computer systems contribution, not a study of research.

GPT-5.6 (high)OUT
genre : empirical
porte sur le Canada: non
confiance: high

The work studies GPU job scheduling for machine-learning workloads, not research as a system or practice.

Grok 4.5OUT
genre : empirical
porte sur le Canada: non
confiance: high

Systems paper on GPU-cluster job scheduling for deep learning workloads, not study of research practice.

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,002
score de la tête « metaresearch » (Gemma)0,004
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesaucune
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Simulation ou modélisation · Signal consensuel: Simulation ou modélisation
GenreSignal candidat: Empirique · Signal consensuel: aucune
Score de désaccord entre enseignants0,007
Score d'incertitude au seuil0,000

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,0020,004
Méta-épidémiologie (sens strict)0,0010,001
Méta-épidémiologie (sens large)0,0010,000
Bibliométrie0,0010,001
Études des sciences et des technologies0,0010,001
Communication savante0,0010,001
Science ouverte0,0040,002
Intégrité de la recherche0,0010,001
Charge utile insuffisante (le modèle a refusé de juger)0,0030,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,024
Tête enseignante GPT0,254
Écart entre enseignants0,230 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.

Les modèles n’ont appliqué aucune catégorie : rien dans la taxonomie ne correspondait à ce travail.
Devis d'étudeSimulation ou modélisation
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations2
Publié2021
Routes d'admission1
Résumé présentoui

Explorer davantage

Même sujetDistributed and Parallel Computing SystemsTravaux en français237 207