CNIPA.AI
Back to Search
Dossier

面向大语言模型检索增强生成的文件处理方法和装置

InventionActive
10Claims · 3 independent
§ Ⅰ

Dossier Overview

Inventor

丁鑫栋; 陈启; 范凌

IPC Classification

G06F 16/16 (2019.01)G06F 40/117 (2020.01)G06V 30/42 (2022.01)G06F 16/172 (2019.01)G06F 16/14 (2019.01)

本公开的实施例提供一种面向大语言模型检索增强生成的文件处理方法和装置,该方法包括:根据不同的文件类型对文件进行信息提取和语义信息增强,并结合企业业务场景,构建文件的元信息结构;基于元信息结构,将文档内容划分成多个结构化的块,并标注每个分块的标题和上下文信息;当文件被上传时,根据文件所在目录的父目录素材数量和内容变化,对目录进行脏标记;当接收到数据请求时,判断相关目录是否存在脏标记,若存在,则请求锁定该目录,通过大语言模型对从下往上抽取的文件提取总结,并将总结缓存后清除脏标记。

External Resources