検索に戻る
案件記録
一种基于混合语法模型的中英文文献语法处理方法
発明有効
1閲覧数
8請求項 · 1 独立
§ Ⅰ
案件概要
発明者
李萌; 李牧遥; 张涛; 陈修迪; 戴怀睿; 单秋甫; 许力; 蒋佳芮; 苏杨; 王文元
IPC分類
G06F 40/253 (2020.01)G06F 40/284 (2020.01)G06F 40/289 (2020.01)G06F 40/216 (2020.01)
本发明公开了一种基于混合语法模型的中英文文献语法处理方法,其特征在于,包括如下步骤:(1)使用分词与语言识别模块将原始文献文本切分为词语或短语,同时识别每个词语或短语的语言属性为中文或英文;(2)将切分为词语或短语后的文本输入到混合语法模型模块中进行初次分析;所述混合语法模型模块包括规则子模型和统计子模型;(3)对初次分析的结果进行融合,然后进行总置信度C评分;若C≥0.95,则分析结果可信;若C<0.95,则重复步骤(2)进行二次分析、三次分析……进行优化,直到C≥0.95。本发明的方法解决了现有技术中英文混杂的长难句和专业术语时的文献语法分析精度下降的问题。
外部リソース