{"id":"W4417251985","doi":"10.1109/lra.2025.3643304","title":"An Intention-Guided Reinforcement Learning Approach With Dirichlet Energy Constraint for Heterogeneous Multi-Robot Cooperation","year":2025,"lang":"","type":"article","venue":"IEEE Robotics and Automation Letters","topic":"Reinforcement Learning in Robotics","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Guelph","funders":"National Natural Science Foundation of China","keywords":"Reinforcement learning; Observability; Constraint (computer-aided design); Adaptability; Process (computing); Robot; Variety (cybernetics); Convergence (economics); Software deployment","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00141409,0.0009618651,0.001630427,0.0005796736,0.0005176794,0.0008352876,0.002422615,0.001419604,0.003126088],"category_scores_gemma":[0.002976852,0.0005680965,0.0007777009,0.0004695276,0.001215791,0.001230067,0.0017537,0.001681901,0.0004384266],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001005016,"about_ca_system_score_gemma":0.001346492,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006130075,"about_ca_topic_score_gemma":0.004493633,"domain_scores_codex":[0.9993292,0.0002435579,0.00003212517,0.0001417043,0.0001359843,0.000117483],"domain_scores_gemma":[0.9985434,0.0008766614,0.0001502827,0.00008713437,0.0001979215,0.0001445005],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008086779,0.00007316351,0.0004466431,0.00004956145,0.000050121,0.0001444401,0.00008169035,0.9539784,0.001044938,0.01892776,0.0009937155,0.02412869],"study_design_scores_gemma":[0.00001038627,0.00001057369,0.0000204173,0.000001929072,0.000003253325,0.000004739377,0.000003235441,0.9963452,0.00007483816,0.003413061,0.0001089199,0.000003415501],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01451748,0.0001799518,0.9818076,0.0002973684,0.00004762339,0.00003677328,0.00002763527,0.0001804529,0.002905121],"genre_scores_gemma":[0.8847725,0.0001692243,0.1085166,0.0002776091,0.00007613239,0.0002575381,0.0001076338,0.00008289826,0.005739802],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006130075,"threshold_uncertainty_score":0.01218879,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02288764740421956,"score_gpt":0.2665150292735213,"score_spread":0.2436273818693018,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}