[发明专利]一种语音分析的系统和方法在审
申请号: | 202010106462.7 | 申请日: | 2020-02-21 |
公开(公告)号: | CN111739556A | 公开(公告)日: | 2020-10-02 |
发明(设计)人: | 屈华民;陈远哲;傅四维;袁林萍;伍翱宇 | 申请(专利权)人: | 蓝星球培训 |
主分类号: | G10L25/51 | 分类号: | G10L25/51;G10L25/69;G06F16/64;G06F16/683;G10L19/02 |
代理公司: | 深圳尚业知识产权代理事务所(普通合伙) 44503 | 代理人: | 文蓉 |
地址: | 美国新泽西州蒙*** | 国省代码: | 暂无信息 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | |||
搜索关键词: | 一种 语音 分析 系统 方法 | ||
1.一种处理音频信号的计算机实现的方法,包括以下步骤:
从所述音频信号中提取韵律特征;
利用源自所述音频信号或与所述音频信号相关联的脚本将提取的韵律特征校准;以及
利用所述校准的提取的韵律特征将所述脚本分割成第一类型的结构块。
2.根据权利要求1所述的方法,其中所述音频信号包括人类语音的数字音频剪辑或从文本生成的计算机合成语音的数字音频剪辑。
3.根据权利要求1所述的方法,其中所述分割步骤将所述脚本和所述校准的提取的韵律特征同时分割成第一类型的结构块,其中分割的所述脚本的第一类型的结构块包括构成所述脚本的分句、短语或句子中的任意一个或任意组合。
4.根据权利要求1所述的方法,其中从所述音频信号中提取所述韵律特征以形成具有预定义的、选择的或计算的采样率的时间序列。
5.根据权利要求4所述的方法,其中,在利用源自所述音频信号或与所述音频信号相关联的脚本将提取的韵律特征校准后,构成所述脚本的每个第二类型的结构块被标记以开始时间戳和结束时间戳中的一个或两个,其中,构成所述脚本的第二类型的结构块包括一元字母组、二元字母组和三元字母组中的任意一个或任意组合。
6.根据权利要求1所述的方法,进一步包括以下步骤:
确定源自所述脚本的所述第一类型的结构块与所述第一类型的另一结构块之间的距离测度。
7.根据权利要求6所述的方法,其中所述距离测度包括源自所述脚本的所述第一类型的结构块与所述第一类型的另一结构块之间的相似性测度。
8.根据权利要求6所述的方法,进一步包括以下步骤:
对于源自所述脚本的所述第一类型的结构块和所述第一类型的另一结构块中的每一个,提取包括第二类型的结构块的每个所述第一类型的结构块的词性(POS)标签,以形成POS序列;以及
计算源自所述脚本的所述第一类型的结构块的所述POS与所述第一类型的另一结构块的所述POS之间的编辑距离。
9.根据权利要求8所述的方法,其中使用Damerau-Levenshtein距离来计算源自所述脚本的所述第一类型的结构块的所述POS与所述第一类型的另一结构块的所述POS之间的所述编辑距离。
10.根据权利要求7所述的方法,其中源自所述脚本的所述第一类型的结构块与所述第一类型的另一结构块之间的所述相似性测度由下式确定:
其中CSS1和CSS2分别包括源自所述脚本的所述第一类型的结构块和所述第一类型的另一结构块,并且其中CSS(S1,S2)是计算出的相似性测度。
11.一种用于处理音频信号的系统,所述系统包括:
信号分析模块,用于从所述音频信号中提取韵律特征;
信号校准模块,用于利用源自所述音频信号或与所述音频信号相关联的脚本将提取的韵律特征校准;以及
脚本分割模块,用于利用提取的韵律特征将所述脚本分割成第一类型的结构块。
12.一种搜索语音数据集的计算机实现的方法,所述方法包括以下步骤:
从包括脚本的所述语音数据集的一部分接收包括第一类型的结构块的用户输入;
提取包括第二类型的结构块的每个输入的所述第一类型的结构块的词性(POS)标签,以形成输入的所述第一类型的结构块的POS序列;以及
将输入的所述第一类型的结构块的所述提取的POS序列与所述语音数据集中的所述第一类型的结构块的POS序列进行比较,从而识别所述语音数据集中具有与输入的所述第一类型的结构块相同或相似的POS的一个或多个所述第一类型的其他结构块。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于蓝星球培训,未经蓝星球培训许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/pat/books/202010106462.7/1.html,转载请声明来源钻瓜专利网。
- 上一篇:评价装置
- 下一篇:真无线耳机及其敲击实现操作控制的方法、装置和系统