[发明专利]一种面向用户查询意图的汉语句子相似度分层计算方法及装置有效
申请号: | 201410341855.0 | 申请日: | 2014-07-17 |
公开(公告)号: | CN104133812B | 公开(公告)日: | 2017-03-08 |
发明(设计)人: | 张仰森;李景玉 | 申请(专利权)人: | 北京信息科技大学;张仰森 |
主分类号: | G06F17/27 | 分类号: | G06F17/27;G06F17/30 |
代理公司: | 北京科亿知识产权代理事务所(普通合伙)11350 | 代理人: | 汤东凤 |
地址: | 100101 北*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明提供了一种面向用户查询意图的汉语句子相似度分层计算方法及装置,通过采用去除句末标点的编辑距离句子相似度算法对数据集进行相似度计算,确定一部分满足阈值的句子为相似句子,再采用基于关键词特征和语义特征的句子相似度算法,对数据集中的非相似句子进行相似度计算,从而再次确定一部分满足阈值的句子为相似句子,最后采用面向用户意图的句子相似度算法,对数据集中的非相似句子进行句子相似度计算,确定一部分满足阈值的句子为相似句子。至此,得到数据集中的所有相似句子。本发明计算简洁,效果良好,可以有效解决关键词差异大、长度长、句子结构复杂等问题。 | ||
搜索关键词: | 一种 面向 用户 查询 意图 汉语 句子 相似 分层 计算方法 装置 | ||
【主权项】:
一种面向用户查询意图的汉语句子相似度分层计算方法,其特征在于包括以下步骤:S1、采用去除句末标点的编辑距离句子相似度算法对数据集进行相似度计算,确定一部分满足阈值的句子为相似句子;S2、采用基于关键词特征和语义特征的句子相似度算法,对数据集中的非相似句子进行相似度计算,从而再次确定一部分满足阈值的句子为相似句子;S3、采用面向用户意图的句子相似度算法,对数据集中的非相似句子进行句子相似度计算,确定一部分满足阈值的句子为相似句子,至此得到数据集中的所有相似句子。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于北京信息科技大学;张仰森,未经北京信息科技大学;张仰森许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201410341855.0/,转载请声明来源钻瓜专利网。
- 上一篇:一种样本属性的动态分布数据获取方法及系统
- 下一篇:一种新型的计算器