검색으로 돌아가기
기록
语音识别纠错方法及装置
발명유효
3조회수
12청구항 · 4 독립항
§ Ⅰ
개요
발명자
唐海桃; 吴明辉; 刘雪铃; 廖睿智; 段皋翔
IPC 분류
G10L 15/06 (2013.01)G10L 15/18 (2013.01)G10L 15/20 (2006.01)G10L 15/26 (2006.01)
本发明提供一种语音识别纠错方法及装置,涉及数据处理技术领域,包括:将待识别用户音频中的当前音频帧输入语音识别模型,得到当前音频帧的声学特征和第一文本字符;将当前音频帧的声学特征和第一文本字符,以及历史修正文本序列,输入语音识别纠错模型,得到当前音频帧对应的修正文本字符;其中,历史修正文本序列是待识别用户音频中在当前音频帧之前的历史音频帧,依次经过语音识别模型和语音识别纠错模型后得到的修正文本序列;语音识别纠错模型是基于携带有强制对齐文本标签的训练样本训练得到的,强制对齐文本标签是将训练样本对应的真实文本标签与训练样本对应的语音样本信号进行强制对齐后得到的。