无人艇集群最优协同控制反演
2021-01-16张振华俞成浦
水下无人系统学报 2020年6期
张振华, 李 尧, 俞成浦
无人艇集群最优协同控制反演
张振华, 李 尧, 俞成浦*
(北京理工大学 自动化学院, 北京, 100081)
为实现通过数据驱动学习人为操作下的无人艇集群最优协同控制策略, 文中提出了一种线性二次型闭环微分博弈反演优化算法, 根据观测到的系统最优状态和控制输入轨迹辨识协同策略目标函数。首先, 根据观测到的含加性白噪声的最优系统状态和控制输入轨迹辨识最优反馈矩阵; 然后, 通过求解由纳什平衡充要条件推出的耦合代数黎卡提方程的解来辨识协同策略目标函数。所提出的反演优化算法能够获得满足给定系统状态和控制输入轨迹的最优协同策略目标函数; 同时, 该算法辨识出的目标函数可以用于实现针对特定任务场景的无人艇集群最优协同控制, 并为集群的对抗博弈提供新的思路和解决方案。
无人艇集群; 最优协同控制; 反演优化; 耦合代数黎卡提方程
0 引言
无人艇集群能在复杂海况下执行协同任务, 其在军用和民用领域的应用前景十分广泛。针对给定的任务目标, 无人艇集群的理想行为可以看作是其最优协同控制的结果[1-2]。在实际应用中, 实现最优的协同控制必须有最优的定量协同策略作为具体评价标准, 也就是无人艇集群在任务执行期间的决策和行为应使某些目标函数的值达到最优(一般是最小值)。由于无人艇集群工作环境的复杂性和拓扑连接的多样性, 其最优协同控制策略很难直接采用强化学习等方法试探[3]。……
登录APP查看全文
