CNIPA.AI
검색으로 돌아가기
기록

基于多智能体动态调度的可控语音生成方法和装置

발명유효
10청구항 · 2 독립항
§ Ⅰ

개요

발명자

陈晋音; 方正; 叶林辉; 郑海斌

IPC 분류

G10L 13/047 (2013.01)G10L 13/10 (2013.01)

本发明公开了一种基于多智能体动态调度的可控语音生成方法和装置,属于语音合成技术领域,包括:构建包括中央调度模块、身份智能体、情感智能体和环境智能体的多智能体语音生成框架;通过中央调度模块解析用户指令并输出结构化任务计划,以驱动各智能体分别生成身份、情感及环境维度的初级语音输出,并据此构建智能体间协作成本矩阵;基于成本矩阵通过优化算法求解多智能体的最优执行路径,基于最优执行路径级联执行各智能体,最终完成混音并输出高质量语音。本发明能够显著提升合成语音在复杂场景下的自然度、语义一致性与整体质量,适用于智能语音助手、虚拟数字人、沉浸式娱乐、无障碍语音服务、个性化内容创作等多种人机交互应用场景。