[发明专利]一种基于CNN-LSTM的图像字幕压缩方法在审
申请号: | 202110257657.6 | 申请日: | 2021-03-09 |
公开(公告)号: | CN113326840A | 公开(公告)日: | 2021-08-31 |
发明(设计)人: | 王小华;令狐彬;焦璐璐;宋晓晨 | 申请(专利权)人: | 山西三友和智慧信息技术股份有限公司 |
主分类号: | G06K9/32 | 分类号: | G06K9/32;G06F16/174;G06N3/04;G06N3/08 |
代理公司: | 深圳科润知识产权代理事务所(普通合伙) 44724 | 代理人: | 李小妮 |
地址: | 030000 山西省*** | 国省代码: | 山西;14 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明属于图像处理技术领域,具体涉及一种基于CNN‑LSTM的图像字幕压缩方法,包括如下步骤:数据采集、数据预处理、模型构建、模型评价,所述数据采集下载公共数据集flickr8k,对获取图像进行数据标注,根据图像内容进行描述,完成数据集构建;所述数据预处理对数据集进行预处理,包括尺度缩放、数据归一化和数据划分三种方式;所述模型构建采用CNN‑LSTM模型用于数据训练,模型由编码器VGG16和解码器LSTM组成,编码器获取提取的特征,并使用特征来训练解码器,同时将部分不太重要的权值进行修剪,并将解码器使用的LSTM模型进行量化处理;所述模型评价当模型的损失函数不再降低之后,保存模型,并进行评价。 | ||
搜索关键词: | 一种 基于 cnn lstm 图像 字幕 压缩 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于山西三友和智慧信息技术股份有限公司,未经山西三友和智慧信息技术股份有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202110257657.6/,转载请声明来源钻瓜专利网。
- 彩色图像和单色图像的图像处理
- 图像编码/图像解码方法以及图像编码/图像解码装置
- 图像处理装置、图像形成装置、图像读取装置、图像处理方法
- 图像解密方法、图像加密方法、图像解密装置、图像加密装置、图像解密程序以及图像加密程序
- 图像解密方法、图像加密方法、图像解密装置、图像加密装置、图像解密程序以及图像加密程序
- 图像编码方法、图像解码方法、图像编码装置、图像解码装置、图像编码程序以及图像解码程序
- 图像编码方法、图像解码方法、图像编码装置、图像解码装置、图像编码程序、以及图像解码程序
- 图像形成设备、图像形成系统和图像形成方法
- 图像编码装置、图像编码方法、图像编码程序、图像解码装置、图像解码方法及图像解码程序
- 图像编码装置、图像编码方法、图像编码程序、图像解码装置、图像解码方法及图像解码程序