您当前的位置:
首页 >
文章列表页 >
基于异步合作更新的LSTM-MADDPG多智能体协同决策算法
通信与控制工程 | 更新时间:2025-05-26
    • 基于异步合作更新的LSTM-MADDPG多智能体协同决策算法

    • LSTM⁃MADDPG multi⁃agent cooperative decision algorithm based on asynchronous collaborative update

    • 在多智能体协同决策领域,研究者提出了LSTM-MADDPG算法,优化全局奖励划分,提升训练稳定性,为解决多智能体合作问题提供新方案。
    • 吉林大学学报(工学版)   2024年54卷第3期 页码:797-806
    • 作者机构:

      1.哈尔滨工程大学 信息与通信工程学院, 哈尔滨 150001

      2.北京航天长征飞行器研究所 试验物理与计算数学国家级重点实验室, 北京 100076

    • 作者简介:

      高敬鹏(1980-),男,副教授,博士.研究方向:深度强化学习.E-mail:gjpmcu@126.com

    • 基金信息:
      电子信息系统复杂电磁环境效应国家重点实验室项目(CEMEE2021G0001)
    • DOI:10.13229/j.cnki.jdxbgxb.20220523    

      中图分类号: TP18
    • 收稿:2022-05-06

      纸质出版:2024-03-01

    移动端阅览

  • 高敬鹏,王国轩,高路.基于异步合作更新的LSTM-MADDPG多智能体协同决策算法[J].吉林大学学报(工学版),2024,54(03):797-806. DOI: 10.13229/j.cnki.jdxbgxb.20220523.

    GAO Jing-peng,WANG Guo-xuan,GAO Lu.LSTM⁃MADDPG multi⁃agent cooperative decision algorithm based on asynchronous collaborative update[J].Journal of Jilin University(Engineering and Technology Edition),2024,54(03):797-806. DOI: 10.13229/j.cnki.jdxbgxb.20220523.

  •  
  •  

0

浏览量

14

下载量

1

CSCD

文章被引用时,请邮件提醒。
提交
工具集
下载
参考文献导出
分享
收藏
添加至我的专辑

相关文章

面向文本游戏的深度强化学习模型
基于强化学习和注意力机制的朝鲜语文本结构发现
基于离散采样的多模态四足机器人路径规划
基于深度强化学习的自动驾驶车辆与行人交互建模
基于机器学习的汽车设计智能拟合方法

相关作者

刘勇
徐雷
张楚晗
赵亚慧
杨飞扬
张振国
崔荣一
孙帅帅

相关机构

黑龙江大学 计算机科学技术学院
延边大学 计算机科学与技术系,吉林 延吉
中国科学技术大学 工程科学学院
安徽大学 电气工程与自动化学院
北京工业大学 城市建设学部
0