Back to Search
Dossier
融合情感计算的数字人直播语音交互系统
InventionActive
10Claims · 1 independent
§ Ⅰ
Dossier Overview
Applicant
北京众声昇数字科技有限公司
Inventor
周硕; 柴帼英; 郑艺坤; 张群逸
IPC Classification
G10L 15/22 (2006.01)G10L 25/63 (2013.01)G10L 25/87 (2013.01)
本发明涉及数字人语音交互技术领域,公开了融合情感计算的数字人直播语音交互系统。系统通过获取用户语音输入数据流,构建情感响应时间窗口,其起点为用户语音输入数据流的结束时刻,终点为预设最大响应截止时刻减去语音响应合成必要时长。系统实时获取用户的情感状态向量,并判断其是否达到情感强度阈值;若达到阈值,则预测数字人语音响应的总生成时长。当情感响应时间窗口的剩余时长与总生成时长相等时,以窗口起点作为语音响应起始时刻,控制数字人启动语音响应生成。该系统通过精细化的时间窗口管理与情感状态感知,生成与用户情感状态相适配的语音响应,减少无效响应与交互延迟,提升了数字人直播语音交互的自然性与用户体验。
External Resources