[00287479]基于局部敏感哈希技术的多标记文件近邻查询方法
交易价格:
面议
类型:
发明专利
技术成熟度:
正在研发
专利所属地:中国
专利号:CN201510150666.X
交易方式:
完全转让
许可转让
技术入股
联系人:
南京邮电大学
所在地:江苏南京市
- 服务承诺
- 产权明晰
-
资料保密
对所交付的所有资料进行保密
- 如实描述
技术详细介绍
本发明公开了一种基于局部敏感哈希技术的多标记学习的设计方法,该方法将海量文件问题转化为多标记学习问题,建立海量文件的近邻索引表;海量文件的多标记训练;新文件的预测标记向量;基于LSH的多标记学习文件近邻查询。给定海量文件样本X,关键词,文件查询结果,按照查询结果得到文件标记向量集合Y;对标记向量集Y执行LSH算法,得到基于标记文件的近邻索引表;文件样本X根据多标记学习算法构建多标记分类器;对于新文件,首先进行上述两个步骤,然后根据多标记分类器,得到预测的标记集合;新文件的标记向量执行LSH查询,得到候选样本文件;对候选样本文件进行线性搜索,获取近邻文件。