検索に戻る
案件記録

一种高效的联邦向量数据库检索方法

発明有効
1閲覧数
10請求項 · 1 独立
§ Ⅰ

案件概要

発明者

童咏昕; 王宇翔; 胡睿希; 贺梓源; 李书缘

IPC分類

G06F 16/242 (2019.01)G06F 16/22 (2019.01)G06F 16/23 (2019.01)G06F 16/27 (2019.01)

本发明提供一种高效的联邦向量数据库检索方法,基于贡献的联邦近似最近邻搜索算法,根据各个参与方在前几轮中的累积贡献,自适应选择参与方中的数据,利用跨数据孤岛之间的非独立同分布现象,动态调整每个孤岛的采样数量,减少不相关候选数量,降低重嵌入开销与提高查询精度;还确保所有的数据孤岛均有非零的被采样概率,降低不良候选对象导致的采样偏差,提高查询的整体精度和实现低查询延迟;并且无需依赖特定的查询嵌入模型与数据孤岛的嵌入模型,也无需依赖数据孤岛内部的索引结构,具有广泛的适用性。

外部リソース