论文摘要
针对传统的建模研究方法在应用于无人水面艇集群时会遇到复杂的动态海洋环境问题,提出了一种新的多智能体马尔可夫决策过程控制框架,将一致性控制和势博弈理论结合起来.在强化学习过程中,通过映射每个智能体的动作-价值函数值(Q值)表到全局最大势函数表,从而得到最优联合决策矩阵用于协同控制.进行了仿真试验,根据平均回报值给出了分析结果,验证了控制器决策矩阵的自优化性,以及对于较大环境扰动的自适应性.
论文目录
文章来源
类型: 期刊论文
作者: 曹诗杰,陈于涛,曾凡明
关键词: 无人艇,集群控制,一致性,强化学习,势博弈
来源: 华中科技大学学报(自然科学版) 2019年09期
年度: 2019
分类: 工程科技Ⅱ辑,信息科技
专业: 船舶工业,自动化技术
单位: 海军工程大学动力工程学院
基金: 中国博士后科学基金资助项目(201150M1547),湖北省自然科学基金资助项目(2013CFB440)
分类号: U664.82;TP181;TP273
DOI: 10.13245/j.hust.190908
页码: 42-47
总页数: 6
文件大小: 759K
下载量: 623