CNIPA.AI
검색으로 돌아가기
기록

基于不确定性估计的强化学习驾驶决策方法和系统

발명유효
9청구항 · 3 독립항
§ Ⅰ

개요

발명자

刘佳; 寇雨然; 徐坤; 孙天夫

IPC 분류

B60W 50/00 (2006.01)B60W 10/04 (2006.01)B60W 10/18 (2012.01)B60W 10/20 (2006.01)G06N 20/00 (2019.01)

本公开涉及自动驾驶决策,尤其涉及基于不确定性估计的强化学习驾驶决策方法和系统,用于解决现有强化学习难以在驾驶决策中全面、准确地量化多源不确定性以提高安全性的问题。本方案在预设第一驾驶策略基础上,增设适用于高动态交通场景下的第二驾驶策略,包括:对训练好的k个Q网络,估计环境偶然不确定性和认知不确定性,若二者均未超出其设定的阈值,则执行第二驾驶策略,否则执行第一驾驶策略。本方案通过考虑不确定性的同时,设计切换机制,当估计的不确定性(无论哪种)超过预设安全阈值时,能主动可靠地将驾驶策略切换至预设的保守候选策略,从而在高动态、高风险的混合交通场景中有效规避潜在风险,保障行车安全。