검색으로 돌아가기
기록
实时视频语义分割的神经网络优化系统及方法
발명유효
1조회수
8청구항 · 2 독립항
§ Ⅰ
개요
발명자
朱广佳; 李祉航
IPC 분류
G06V 20/40 (2022.01)G06V 10/80 (2022.01)G06V 10/82 (2022.01)G06V 20/70 (2022.01)G06N 3/006 (2023.01)G06N 3/0464 (2023.01)G06N 3/0985 (2023.01)
本发明公开了一种实时视频语义分割的神经网络优化系统及方法,属于计算机视觉与人工智能技术领域。该方法包括采集原始视频流并进行像素级语义标注,输出包含视频帧序列及其对应标注序列的训练数据集,对训练数据集中的视频帧序列进行预处理,输出规整的图像帧序列单元张量,构建并训练一个双分支时空语义分割网络,双分支时空语义分割网络的输入为图像帧序列单元张量,输出为当前帧的语义分割概率图,将预处理得到的实时图像帧序列单元张量,连续输入训练好的所述双分支时空语义分割网络,实时输出与输入视频流同步的语义分割概率图序列。本发明在轻量化模型下,实现视频语义分割精度、时间一致性与实时性的高效平衡,显著优于传统逐帧处理方法。