{"id":"W4317419678","doi":"10.1109/vtc2022-fall57202.2022.10012942","title":"Heterogeneous Mean-Field Multi-Agent Reinforcement Learning for Communication Routing Selection in SAGI-Net","year":2022,"lang":"en","type":"article","venue":"2022 IEEE 96th Vehicular Technology Conference (VTC2022-Fall)","topic":"UAV Applications and Optimization","field":"Engineering","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"Tsinghua Shenzhen International Graduate School; Tsinghua University","keywords":"Reinforcement learning; Computer science; Routing (electronic design automation); Communications system; Distributed computing; Selection (genetic algorithm); Efficient energy use; Field (mathematics); Telecommunications network; Communications satellite; Satellite; Artificial intelligence; Computer network; Mathematics; Electrical engineering; Aerospace engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009670481,0.0005916483,0.0007909351,0.0002796089,0.0003994678,0.0005649899,0.0009557146,0.0006662072,0.0009311265],"category_scores_gemma":[0.001572285,0.0002557847,0.0003362402,0.0002241196,0.0006453622,0.0007048445,0.0006891838,0.000823012,0.0001099013],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008670676,"about_ca_system_score_gemma":0.0008700909,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005490394,"about_ca_topic_score_gemma":0.004921614,"domain_scores_codex":[0.9996431,0.0001305853,0.0000129914,0.00007227097,0.00007846033,0.00006267488],"domain_scores_gemma":[0.9993718,0.0003140091,0.00009900617,0.00003065995,0.0001227333,0.00006176392],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003123386,0.00002928862,0.0004018123,0.0000149879,0.00001570744,0.00003141578,0.00001727116,0.9874172,0.0005944101,0.002360813,0.0002416367,0.008844197],"study_design_scores_gemma":[0.000002890707,0.00001124117,0.00002834988,6.128225e-7,0.000001656658,0.000002343986,0.000002059484,0.999421,0.00006367706,0.0004178103,0.00004714424,0.000001166639],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.07185999,0.0002516044,0.9240927,0.0002956399,0.00005977045,0.00005937005,0.00002838175,0.0002464371,0.003105944],"genre_scores_gemma":[0.9693504,0.0000703987,0.02888778,0.00009786052,0.00002192999,0.00006378773,0.000029395,0.00001638598,0.001462007],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005490394,"threshold_uncertainty_score":0.01091689,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.01490423555588995,"score_gpt":0.2346709295781379,"score_spread":0.219766694022248,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}