CNIPA.AI
검색으로 돌아가기
기록

一种基于鲁棒PPO及数据驱动DOB的车队协同控制方法

발명유효
7청구항 · 1 독립항
§ Ⅰ

개요

발명자

翟春杰; 阮大瑜; 葛满; 付世州; 胡珂瑞; 陈军统; 郭伟刚

IPC 분류

G05B 23/02 (2006.01)

本发明公开了一种基于鲁棒PPO及数据驱动DOB的车队协同控制方法,在鲁棒强化学习的基础上,进一步引入数据驱动的扰动观测器设计,突破传统DOB对显式数学模型的依赖,通过实时数据对系统扰动进行在线估计与补偿。通过对抗训练强化PPO智能体作为鲁棒标称控制器,并借助数据驱动的神经网络估计扰动,结合自适应滤波与安全补偿机制在线修正控制指令,最终实现车队在复杂扰动条件下的安全、舒适、协同行驶。本发明方法不仅增强了RL控制器在未知动态与扰动环境下的鲁棒性,也提升了系统的实时性能与泛化能力,为强化学习控制在复杂实际场景中的安全可靠应用提供了新的解决路径。