[发明专利]一种基于区域表示和视觉表示的视觉问答方法及系统有效
申请号: | 202310768905.2 | 申请日: | 2023-06-28 |
公开(公告)号: | CN116542995B | 公开(公告)日: | 2023-09-22 |
发明(设计)人: | 徐昊;高玲;盛楠;石立达;张洪达 | 申请(专利权)人: | 吉林大学 |
主分类号: | G06T7/11 | 分类号: | G06T7/11;G06N3/0464;G06V10/22;G06V10/764;G06V10/80 |
代理公司: | 北京盛询知识产权代理有限公司 11901 | 代理人: | 相凡 |
地址: | 130012 吉林省长*** | 国省代码: | 吉林;22 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本申请公开了一种基于区域表示和视觉表示的视觉问答方法及系统,其中方法步骤包括:基于Faster R‑CNN模型学得的图像区域特征,为每张待问答图像构建图像区域特征图;基于图像区域特征图,生成邻居增强的区域表示;基于GRU模型学得的问题特征对邻居增强的区域表示进行指导,得到最终的视觉特征;基于区域表示、视觉特征和问题特征,得到预测答案,完成视觉问答。本申请为每张图像构建区域特征图,以表示该图像中所有区域之间的关联和特征。同时,基于带重启的随机行走方法,在区域特征图中学习邻域增强区域表示。此外,还提出一个问题指导的纵横双重注意力机制。机制以问题特征表示作为指导,从区域层面和特征层面增强区域表示。 | ||
搜索关键词: | 一种 基于 区域 表示 视觉 问答 方法 系统 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于吉林大学,未经吉林大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202310768905.2/,转载请声明来源钻瓜专利网。