検索に戻る
案件記録
一种高效的联邦向量数据库检索方法
発明有効
1閲覧数
10請求項 · 1 独立
§ Ⅰ
案件概要
発明者
童咏昕; 王宇翔; 胡睿希; 贺梓源; 李书缘
IPC分類
G06F 16/242 (2019.01)G06F 16/22 (2019.01)G06F 16/23 (2019.01)G06F 16/27 (2019.01)
本发明提供一种高效的联邦向量数据库检索方法,基于贡献的联邦近似最近邻搜索算法,根据各个参与方在前几轮中的累积贡献,自适应选择参与方中的数据,利用跨数据孤岛之间的非独立同分布现象,动态调整每个孤岛的采样数量,减少不相关候选数量,降低重嵌入开销与提高查询精度;还确保所有的数据孤岛均有非零的被采样概率,降低不良候选对象导致的采样偏差,提高查询的整体精度和实现低查询延迟;并且无需依赖特定的查询嵌入模型与数据孤岛的嵌入模型,也无需依赖数据孤岛内部的索引结构,具有广泛的适用性。
外部リソース