申请/专利权人:桂林电子科技大学
申请日:2024-01-15
公开(公告)日:2024-04-12
公开(公告)号:CN117874102A
主分类号:G06F16/2458
分类号:G06F16/2458;G06F16/22;G06F18/23213
优先权:
专利状态码:在审-实质审查的生效
法律状态:2024.04.30#实质审查的生效;2024.04.12#公开
摘要:本发明涉及数据挖掘技术领域,具体涉及一种基于非空倒排多索引结构的近似最近邻搜索方法,在IVFADC检索系统的倒排索引结构基础上进行改进,将IVFADC检索系统第一阶段的倒排表定位视为一个独立的最近邻搜索问题,并基于乘积量化的近似最近邻搜索方法解决。具体的,在IVFADC倒排索引结构的基础上,通过乘积量化对索引倒排列表的聚类中心进行量化编码,倒排列表的索引由原来的聚类中心转变成了相应的乘积量化编码,通过乘积量化的非对称距离以及距离查找表机制,能够提升第一阶段倒排表的定位效率,此外,与原始的倒排多索引相比,本发明方法避免了空表的产生,因此降低了存储倒排多索引结构所需的内存空间。
主权项:1.一种基于非空倒排多索引结构的近似最近邻搜索方法,其特征在于,包括下列步骤:步骤1:利用K-means算法给数据库构建标准倒排表系统;步骤2:在标准倒排表系统上执行乘积量化,构建非空倒排多索引结构;步骤3:使用非空倒排多索引倒排表的定位以及候选列表的生成;步骤4:候选列表重排。
全文数据:
权利要求:
百度查询: 桂林电子科技大学 一种基于非空倒排多索引结构的近似最近邻搜索方法
免责声明
1、本报告根据公开、合法渠道获得相关数据和信息,力求客观、公正,但并不保证数据的最终完整性和准确性。
2、报告中的分析和结论仅反映本公司于发布本报告当日的职业理解,仅供参考使用,不能作为本公司承担任何法律责任的依据或者凭证。