검색으로 돌아가기
기록
一种基于大模型参数高效微调的咳嗽声识别方法
발명유효
1조회수
6청구항 · 1 독립항
§ Ⅰ
개요
발명자
徐华兴; 史振璐; 任海川; 刘旭东
IPC 분류
G10L 25/66 (2013.01)G10L 25/18 (2013.01)G10L 25/24 (2013.01)G10L 25/21 (2013.01)G10L 19/02 (2013.01)G10L 19/022 (2013.01)G10L 19/26 (2013.01)G06N 3/0455 (2023.01)G06N 5/022 (2023.01)
本发明公开了一种基于大模型参数高效微调的咳嗽声识别方法,属于人工智能辅助诊断领域。该方法具体包括:构建包含咳嗽声与非咳嗽声的数据集;将长音频分割为固定长度的音频片段,去除静音片段并统一所有音频片段采样率;将音频片段通过音频特征提取器转换为二维时频谱图,作为后续模型的输入特征;将预训练的音频分类大模型作为骨干网络,在其内部的标准Transformer的Encoder层插入参数高效微调模块;冻结骨干网络的主体参数,仅对参数高效微调模块及模型的分类头的参数进行训练,选择最优模型进行咳嗽声识别;本发明的方法,使用参数高效微调技术,通过在音频分类大模型中插入参数高效微调模块,冻结骨干网络的主体参数的同时对参数高效微调模块及模型的分类头的参数进行训练,在减少训练参数量的同时实现高精度的咳嗽声识别。