A Multi-Agent DRL-Based Dynamic Resource Allocation in O-RAN-Enabled TN-NTN Metaverse Services
Notice bibliographique
Résumé
The integration of terrestrial and non-terrestrial networks (TN-NTN) with open radio access network (O-RAN) technology presents a significant advancement for facilitating scalable and immersive Metaverse services within 6G networks. Seamless virtual experiences necessitate highly reliable, low-latency communication, effective resource management, and adaptive decision-making to satisfy the varied and rigorous requirements of Metaverse applications, including gaming, healthcare, and autonomous systems. The inherent heterogeneity, dynamic nature, and substantial resource requirements of TN-NTN present significant challenges for effective resource allocation and optimizing quality of experience (QoE). Then, we formulate a multi-objective optimization problem for joint resource allocation and spectrum sharing in O-RAN-enabled TN-NTN Metaverse environments. This problem is inherently NP-hard due to the intricate coupling between continuous action spaces and discrete decision variables. Solving such a complex problem using traditional optimization approaches is complex. To overcome this, we transform the problem into a decentralized partially observable Markov decision process (Dec-POMDP) and address it using a hierarchical multi-agent deep reinforcement learning (MADRL) approach. This study presents a hierarchical multi-agent proximal policy optimization (MAPPO) framework, a new MADRL solution for dynamic resource allocation and spectrum sharing in O-RAN-enabled TN-NTN Metaverse environments. MAPPO facilitates collaborative learning among intelligent agents to optimize resource management strategies in a decentralized manner, considering essential metrics, including energy consumption, latency, and meta-distance. The proposed framework enhances resource utilization efficiency, minimizes latency, and improves the QoE for Metaverse users through the seamless allocation and management of resources. Comprehensive simulations show that MAPPO outperforms baseline methods, such as conventional reinforcement learning and centralized optimization approaches, achieving better energy efficiency, lower latency, and improved QoE. This demonstrates its effectiveness in adapting to dynamic 6G-enabled Metaverse requirements, enabling intelligent and scalable TN-NTN networks.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,001 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,001 | 0,001 |
| Science ouverte | 0,001 | 0,002 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,002 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».