検索に戻る
案件記録
基于多维发音表征解耦与融合的ASV系统风险评估方法及系统
発明有効
10請求項 · 3 独立
§ Ⅰ
案件概要
発明者
马金花; 周杰; 李家印; 许胜民
IPC分類
G10L 25/51 (2013.01)G10L 25/18 (2013.01)G10L 25/30 (2013.01)G10L 13/10 (2013.01)
本发明提供一种基于多维发音表征解耦与融合的ASV系统风险评估方法及系统,包括:获取目标用户的参考音频,通过多维发音特征提取网络从中解耦提取音量特征向量、音高特征向量、说话风格特征向量;将待验证文本转换为音素序列,输入用于基于音素序列预测帧级动态发音特征序列的发音特征预测网络,通过自适应实例归一化机制将三种发音特征向量注入网络内部以动态调制预测过程,生成包含时序韵律变化的帧级动态发音特征序列;输入VAE‑GAN合成主干,通过自适应实例归一化机制再次注入三种发音特征向量,生成与目标用户声纹特性一致的测试语音样本;对ASV系统发起身份验证查询,根据验证结果计算不同用户群体的安全性指标,以评估ASV系统的风险。
外部リソース