CNIPA.AI
검색으로 돌아가기
기록

人声背景音实时分离的模型训练方法、模型、方法、装置

발명유효
10청구항 · 6 독립항
§ Ⅰ

개요

발명자

周晨; 钟名富; 汪建强; 郑茳; 肖佐楠; 匡启和

IPC 분류

G10L 21/0272 (2013.01)G10L 21/028 (2013.01)G10L 25/30 (2013.01)

本申请公开了一种人声与多种背景音实时分离的神经网络增强模型的训练方法、模型、方法、装置、存储介质及设备,属于语音分离技术领域,该训练方法包括获取多种类型的音频数据,并进行扩增;将多种扩增的音频数据进行叠加得到原始输入数据;对原始输入数据进行特征提取得到输入特征信息;对第一神经网络模型涉及未来时间帧的层函数进行删除、替换和/或超参调整得到第二神经网络模型;多次利用输入特征信息对第二神经网络模型进行训练,利用损失函数对模型输出结果和目标输出结果进行计算,不断迭代,直至收敛。本申请通过训练一个能实时且同时分离出人声和多种背景音的神经网络增强模型,实现对人声和多种背景音的实时且同时分离,提高了分离度。