[发明专利]票证识别训练样本合成方法和计算机存储介质有效

专利信息
申请号: 201910435628.7 申请日: 2019-05-23
公开(公告)号: CN110163285B 公开(公告)日: 2021-03-02
发明(设计)人: 田强;邓冠群;李树凯 申请(专利权)人: 阳光保险集团股份有限公司
主分类号: G06K9/62 分类号: G06K9/62;G06K9/00
代理公司: 北京超凡宏宇专利代理事务所(特殊普通合伙) 11463 代理人: 崔振
地址: 518000 广东省深圳市福田*** 国省代码: 广东;44
权利要求书: 查看更多 说明书: 查看更多
摘要:
搜索关键词: 票证 识别 训练 样本 合成 方法 计算机 存储 介质
【权利要求书】:

1.一种票证识别训练样本合成方法,其特征在于,包括:

从语料库中读取预选字符集中所包含的字符,若当前读取的字符在字符采样集合中的字频计数小于或等于预设最高字频,则将所述当前读取的字符加入到所述字符采样集合中;

从所述字符采样集合中依次读取字符并生成具有预定长度的样本字符串,将生成的多个样本字符串加入到样本字符串集合;

判断所述样本字符串的数量是否达到预设样本量,并在达到所述预设样本量时停止字符采样;

对各样本字符串进行文字掩码预处理并生成对应的前景文字掩码图像;

将各前景文字掩码图像与对应选取的票证背景图像进行二次图像融合,得到用于票证识别的合成训练样本集合。

2.根据权利要求1所述的票证识别训练样本合成方法,其特征在于,还包括:

停止所述字符采样后,判断所述预选字符集中的每一字符在所述字符采样集合中的字频计数是否小于预设最低字频;

若是,则将小于所述预设最低字频的当前字符补充到字符补充集合中,以使所述当前字符在所述字符补充集合中的字频计数达到所述预设最低字频;

从所述字符补充集合中依次读取字符并生成具有所述预定长度的样本字符串,将生成的样本字符串加入到所述样本字符串集合中。

3.根据权利要求1所述的票证识别训练样本合成方法,其特征在于,所述“将各前景文字掩码图像与对应选取的票证背景图像进行二次图像融合”包括:

根据第一预设融合规则将所述前景文字掩码图像与所述票证背景图像进行融合,以获取第一融合图像;

根据第二预设融合规则对所述第一融合图像进行图像融合,以获取第二融合图像,其中,所述第二融合图像作为用于票证识别的合成训练样本。

4.根据权利要求3所述的票证识别训练样本合成方法,其特征在于,所述“根据第一预设融合规则将所述前景文字掩码图像与所述票证背景图像进行融合”包括:

为所述前景文字掩码图像创建第一图层,所述第一图层的透明度为所述前景文字掩码图像的像素值乘以预设数值集合中的任意一元素,颜色值为集合[0,前景文字掩码图像的像素均值乘以预设倍数]中的一采样取值;

为所述票证背景图像创建第二图层,所述第二图层设为不透明,颜色值为所述票证背景图像的像素均值;

将所述第一图层和所述第一图层进行图像融合,以生成所述第一融合图像。

5.根据权利要求4所述的票证识别训练样本合成方法,其特征在于,所述“根据第二预设融合规则对所述第一融合图像进行图像融合,以获取第二融合图像”包括:

根据所述第一融合图像和所述票证背景图像的梯度值确定所述第二融合图像中前景文本图像的梯度,以用于计算所述前景文本图像的散度;

根据所述票证背景图像在边缘位置的散度及所述前景文本图像的散度计算所述第二融合图像的散度,并构建泊松方程;

对所述泊松方程进行求解,以得到所述第二融合图像。

6.根据权利要求1所述的票证识别训练样本合成方法,其特征在于,所述“对各样本字符串进行文字掩码预处理并生成对应的前景文字掩码图像”包括:

按照预设字体处理规则对各样本字符串进行相应的字体效果处理;

在完成所述字体效果处理之后,生成各样本字符串对应的初始前景文字掩码图像;

从所述初始前景文字掩码图像中截取文字区域掩码图像,并根据选取的票证背景图像的尺寸和预设边距值调整所述文字区域掩码图像的尺寸,然后将调整后的文字区域掩码图像进行像素填充,得到与所述票证背景图像尺寸相同的各前景文字掩码图像。

7.根据权利要求6所述的票证识别训练样本合成方法,其特征在于,所述“从所述初始前景文字掩码图像中截取文字区域掩码图像”步骤之后,还包括:

对所述文字区域掩码图像进行倾斜处理、透视变换处理和模糊处理中的至少一种操作。

下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。

该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于阳光保险集团股份有限公司,未经阳光保险集团股份有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服

本文链接:http://www.vipzhuanli.com/pat/books/201910435628.7/1.html,转载请声明来源钻瓜专利网。

×

专利文献下载

说明:

1、专利原文基于中国国家知识产权局专利说明书;

2、支持发明专利 、实用新型专利、外观设计专利(升级中);

3、专利数据每周两次同步更新,支持Adobe PDF格式;

4、内容包括专利技术的结构示意图流程工艺图技术构造图

5、已全新升级为极速版,下载速度显著提升!欢迎使用!

请您登陆后,进行下载,点击【登陆】 【注册】

关于我们 寻求报道 投稿须知 广告合作 版权声明 网站地图 友情链接 企业标识 联系我们

钻瓜专利网在线咨询

周一至周五 9:00-18:00

咨询在线客服咨询在线客服
tel code back_top