検索に戻る
案件記録

基于改进DeBERTa模型的文件语义相似度计算方法

発明有効
8請求項 · 1 独立
§ Ⅰ

案件概要

発明者

郑长亮; 杨洪雪; 李云舒; 杨建兴; 赵凯; 石泽宏; 陈涵

IPC分類

G06F 40/30 (2020.01)G06F 18/22 (2023.01)G06F 40/289 (2020.01)

本发明公开了基于改进DeBERTa模型的文件语义相似度计算方法,包括:将文件按结构划分,标注角色标签并完成去噪与编码,生成层级化输入序列;输入序列经改进DeBERTa模型编码,输出多层级语义向量与结构语义表示;构建语义能量共振图,计算层级间能量传导与耦合强度,生成共振谱特征;统计多层级能量分布与共振强度,形成描述结构稳定性的能量谱特征向量;构建语义场曲率函数,映射能量与语义表示至统一空间,获取对齐表示;融合能量谱特征与语义对齐表示,计算综合语义相似度并输出最终结果。本发明通过改进DeBERTa模型并引入语义能量共振与曲率自对齐机制,实现长文本语义相似度高精度计算。

外部リソース