検索に戻る
案件記録

一种视频内容智能识别系统和方法及智能座椅

発明有効
1閲覧数
13請求項 · 4 独立
§ Ⅰ

案件概要

発明者

梅薇芳; 詹玉嵩; 崔传武; 陈迪璞; 王琰

IPC分類

G06V 20/40 (2022.01)G06F 18/213 (2023.01)G06F 18/25 (2023.01)G06N 3/0455 (2023.01)G06N 3/0442 (2023.01)G06N 3/0464 (2023.01)

本发明公开了一种视频内容智能识别系统,它包括:多源数据采集模块,用于同步采集视频流、音频流和车辆动态参数信号;时空对齐预处理模块,用于对齐多源信号时间基准并建立视频关键帧与车辆信号的映射关系;跨模态特征融合模块,用于提取并动态加权融合多模态特征;流式文本生成模块,用于根据融合特征生成带时间戳的文本片段。本发明解决了现有视频识别技术因忽略动态上下文导致的摘要失真及跨模态转换不准确问题,显著提升了车内影音内容理解的准确性与实时性。

外部リソース