検索に戻る
案件記録
一种统一多语种语法纠错模型及方法
発明有効
10請求項 · 3 独立
§ Ⅰ
案件概要
発明者
徐亚波; 李旭日; 黄于晏; 何宇轩; 于德强
IPC分類
G06F 40/253 (2020.01)G06F 40/232 (2020.01)G06F 40/284 (2020.01)G06F 40/30 (2020.01)G06F 40/211 (2020.01)G06N 3/0455 (2023.01)
本申请涉及自然语言处理的技术领域,提出一种统一多语种语法纠错模型及方法,所述模型包括:共享编码器和共享解码器;所述共享编码器用于接收若干句输入的待纠错文本序列,并生成每句待纠错文本序列的每个词元的多尺度词元表征和全局句子语义表征;其中,若干句输入的待纠错文本序列的语种总数大于等于1;所述共享解码器用于基于所述多尺度词元表征和全局句子语义表征,自回归地生成每句待纠错文本序列对应的修正文本序列;本模型既能共享跨语言知识,又能清晰地区分并应用各语言特有语法规则。
外部リソース