[发明专利]一种应用于垂直领域的固定格式文档结构化识别的方法在审
申请号: | 202211477364.X | 申请日: | 2022-11-23 |
公开(公告)号: | CN115995088A | 公开(公告)日: | 2023-04-21 |
发明(设计)人: | 李圆法;李钊辉;蔡劲松;赵发君;廖奇;黄洋;王辉 | 申请(专利权)人: | 科讯嘉联信息技术有限公司 |
主分类号: | G06V30/418 | 分类号: | G06V30/418;G06V30/19 |
代理公司: | 合肥正则元起专利代理事务所(普通合伙) 34160 | 代理人: | 王玉 |
地址: | 230000 安徽省合肥市高新区创新大道28*** | 国省代码: | 安徽;34 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种应用于垂直领域的固定格式文档结构化识别的方法,属于图像识别技术领域,具体方法包括:步骤一:定义参照区域和目标区域,制作模板文档;从所有文档中选择无形变的图片,进行图片预处理,根据参照区域和目标区域的定义对文档中的参照区域和目标区域进行标注,形成预定好的模板文档格式;步骤二:生成标记数据;步骤三:对参照区域的OCR检测和识别模型进行优化;步骤四:优化目标区域的OCR识别模型;步骤五:通过优化OCR检测和识别模型与优化OCR识别模型对文档进行结构化识别;利用在通用场景训练好的OCR模型并结合模板匹配,自动生成标记数据,对模型进行优化,无需人为标记垂直领域的文档数据。 | ||
搜索关键词: | 一种 应用于 垂直 领域 固定 格式 文档 结构 识别 方法 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于科讯嘉联信息技术有限公司,未经科讯嘉联信息技术有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202211477364.X/,转载请声明来源钻瓜专利网。