検索に戻る
案件記録

一种低资源语音识别模型的构建方法与装置

発明有効
10請求項 · 4 独立
§ Ⅰ

案件概要

発明者

王大亮; 齐红威; 王佳; 王子昕

IPC分類

G10L 15/06 (2013.01)G10L 19/02 (2013.01)G10L 25/18 (2013.01)G10L 25/24 (2013.01)H04W 4/80 (2018.01)

本发明公开了一种低资源语音识别模型的构建方法和装置,方法包括:预处理准备:从预训练模型中提取线性层权重并配置LoRA参数;初始化构建:构建结构化的低秩适配器,生成融合频谱与相位信息的A/B矩阵初始值,对基础权重进行残差化处理;训练执行:使用低资源数据集,通过参数高效微调框架更新LoRA参数;权重整合及输出最终模型。本发明通过频谱‑相位残差初始化与参数高效微调技术,在不改动原有模型架构的前提下,有效解决了传统低资源场景下模型训练效率低、相位信息丢失、跨环节适配差等技术痛点,显著提升了方言识别、小众词汇识别及热词适配的精度。

外部リソース