{"id":"W4383108558","doi":"10.1109/icra48891.2023.10160919","title":"Multi-Target Pursuit by a Decentralized Heterogeneous UAV Swarm using Deep Multi-Agent Reinforcement Learning","year":2023,"lang":"en","type":"article","venue":"","topic":"Guidance and Control Systems","field":"Engineering","cited_by":45,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Ottawa","funders":"National Research Foundation Singapore","keywords":"Reinforcement learning; Computer science; Drone; Artificial intelligence; Pursuit-evasion; Swarm robotics; Swarm behaviour; Distributed computing; Robot; Evasion (ethics); Machine learning","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006671771,0.0005766752,0.0006179573,0.0002211697,0.0002965372,0.0004884099,0.0008684471,0.0005906037,0.000521305],"category_scores_gemma":[0.001336621,0.0003117064,0.0003483071,0.0001538115,0.000621745,0.0005321446,0.0009184867,0.0007692175,0.0000969828],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00064299,"about_ca_system_score_gemma":0.0008481066,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005612955,"about_ca_topic_score_gemma":0.00471628,"domain_scores_codex":[0.9998178,0.00005018422,0.000007775646,0.00004178602,0.00004234706,0.0000401592],"domain_scores_gemma":[0.9994548,0.0002316951,0.0001008503,0.00005047529,0.00009344531,0.00006877968],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00002736454,0.00002885521,0.0006549587,0.00001076587,0.00001814352,0.00003236371,0.00002124197,0.9866954,0.001068467,0.001250065,0.0001416033,0.01005087],"study_design_scores_gemma":[0.000003056552,0.00001149734,0.00002942286,6.240252e-7,0.000001122685,0.000002020548,0.000001925257,0.9995558,0.00009386785,0.000268703,0.00003130661,6.703534e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1262442,0.000180954,0.8706645,0.0002449774,0.00003941063,0.00004503437,0.00001772962,0.0003594645,0.002203668],"genre_scores_gemma":[0.9685199,0.00003334987,0.03061424,0.00004732877,0.000008626577,0.00003446487,0.00001852122,0.0000122522,0.0007113883],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005612955,"threshold_uncertainty_score":0.01116061,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0250543128912482,"score_gpt":0.2508895084978031,"score_spread":0.2258351956065549,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}