CNIPA.AI
검색으로 돌아가기
기록

基于大模型的语音数据生成方法及训练大模型的方法

발명유효
19청구항 · 8 독립항
§ Ⅰ

개요

발명자

付晓寅; 臧启光; 盛芬芬; 聂兴; 孙涛; 王桂彬; 黄斌; 贾磊

IPC 분류

G10L 13/027 (2013.01)G10L 13/10 (2013.01)G06F 40/30 (2020.01)

本公开提供了基于大模型的语音数据生成方法及训练大模型的方法,涉及人工智能技术领域,尤其涉及语音生成、智慧客服、视频制作等技术领域。基于大模型的语音数据生成方法包括:接收韵律描述文本和语音文本,韵律描述文本描述了对于语音文本中多个文本字的发音韵律意图;利用大模型将韵律描述文本和语音文本进行语义融合,得到韵律融合特征,韵律融合特征中的子特征表征语音片段对于文本字的发音韵律,待生成的目标语音数据包括语音片段;根据韵律融合特征和与指定对象相关的指定发音属性,生成表征指定对象按照发音韵律意图发音,且与语音文本对应的目标语音数据。