[发明专利]一种基于对象规模感知的多标签图像检索方法和系统在审
申请号: | 202310002357.2 | 申请日: | 2023-01-03 |
公开(公告)号: | CN116127119A | 公开(公告)日: | 2023-05-16 |
发明(设计)人: | 谢延昭;魏如凯;刘渝;周可 | 申请(专利权)人: | 华中科技大学 |
主分类号: | G06F16/583 | 分类号: | G06F16/583;G06V10/44;G06V10/75;G06V10/82;G06N3/0455 |
代理公司: | 武汉臻诚专利代理事务所(普通合伙) 42233 | 代理人: | 宋业斌 |
地址: | 430074 湖北省武汉*** | 国省代码: | 湖北;42 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种基于对象规模感知的多标签图像检索方法,其利用感知图像对象规模的哈希质心,构建了一个具有较高检索性能的端到端多标签图像检索方法。本发明提出的方法首先利用Swin Transformer骨干网络作为图像特征提取器,用标签语义信息指导哈希中心点的生成,并提出与对象规模相关的标签亲和度系数的计算方法,二者共同生成包含了对象规模的哈希质心。这些哈希质心作为汉明空间中的锚点,引导多标签图像哈希码不断靠近其对应哈希质心,通过不断的优化基于中心相似性损失函数,使得模型学习到良好的哈希映射关系。本发明使用的哈希质心包含了图像中不同对象的规模信息,结合Swin Transformer骨干网络的强大特征提取能能力,大大提高了图像检索方法的检索性能。 | ||
搜索关键词: | 一种 基于 对象 规模 感知 标签 图像 检索 方法 系统 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于华中科技大学,未经华中科技大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202310002357.2/,转载请声明来源钻瓜专利网。