[发明专利]基于OCR技术辅助构建藏汉音译数据集的方法及系统在审
申请号: | 202310466088.5 | 申请日: | 2023-04-26 |
公开(公告)号: | CN116468054A | 公开(公告)日: | 2023-07-21 |
发明(设计)人: | 徐晓娜;谭晶;赵悦 | 申请(专利权)人: | 中央民族大学 |
主分类号: | G06F40/58 | 分类号: | G06F40/58;G10L15/06;G10L15/26;G10L21/0208;G06F18/15;G06V30/19 |
代理公司: | 北京睿智保诚专利代理事务所(普通合伙) 11732 | 代理人: | 马立峰 |
地址: | 100081 北*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种基于OCR技术辅助构建藏汉音译数据集的方法及系统,应用于数据处理技术领域:提取视频文件源,对带有中文字幕的藏语视频进行分离,得到长音频文件和视频文件;对长音频文件进行切分、数据清洗、重采样、降噪操作,得到音频数据;视频文件通过OCR技术识别字幕,生成中文文本初文件,对中文文本初文件进行数据清洗,并输入藏文字幕,得到文本数据;利用音频数据和文本数据构建藏汉音译数据集。本发明对传统的录制音频采集数据方式加以改进,结合藏语自然口语语音的基本特点,选用有自然口语表达效果的电视访谈节目作为采集来源,整理制作了用于藏汉语音翻译研究的平行语料,为端到端藏汉语音翻译研究提供了一定的数据支撑。 | ||
搜索关键词: | 基于 ocr 技术 辅助 构建 音译 数据 方法 系统 | ||
【主权项】:
暂无信息
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于中央民族大学,未经中央民族大学许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/202310466088.5/,转载请声明来源钻瓜专利网。
- 上一篇:一种利用标签制备多肽的方法
- 下一篇:一种高热值大容量高参数的环保燃气锅炉