検索に戻る
案件記録
一种语音识别标注方法及装置
発明有効
10請求項 · 2 独立
§ Ⅰ
案件概要
発明者
苏卓; 刘嘉宁; 向德军; 蔡新雷; 黎可; 祝锦舟; 郭乾; 庞凯元; 朱炳兆; 杨龙飞; 江里舟; 郭俊宏; 李超; 郝文焕
IPC分類
G10L 15/05 (2013.01)G10L 15/06 (2013.01)G10L 15/26 (2006.01)G10L 25/21 (2013.01)
本发明公开了一种语音识别标注方法及装置,属于语音识别技术领域,该方法为:将待处理语音分离为多个单声道语音;对于每一单声道语音,基于各语音帧的音量幅度计算平均音量能量,并结合预设阈限确定动态能量阈值;基于动态能量阈值,分别计算单声道语音所有语音帧的音量能量差值;对单声道语音内所有语音帧的音量能量差值进行联合分析,识别出多个语音起始点和多个语音结束点;基于各语音起始点和各语音结束点,将单声道语音划分为多个标注区间;分别对各标注区间进行文字识别,生成识别文字结果,并关联识别文字结果和对应的标注区间,生成待处理语音的语音标注文件。因此,通过实施本发明,能够解决现有技术存在的语音识别标注准确性低的问题。
外部リソース