[发明专利]一种面向知识库更新的实体细粒度分类方法与系统有效
申请号: | 201510033050.4 | 申请日: | 2015-01-22 |
公开(公告)号: | CN104615687B | 公开(公告)日: | 2018-05-22 |
发明(设计)人: | 程学旗;王元卓;林海伦;贾岩涛;靳小龙;熊锦华;李曼玲;常雨骁;许洪波 | 申请(专利权)人: | 中国科学院计算技术研究所 |
主分类号: | G06F17/30 | 分类号: | G06F17/30 |
代理公司: | 北京泛华伟业知识产权代理有限公司 11280 | 代理人: | 王勇;李科 |
地址: | 100190 北*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明提供一种面向知识库更新的实体细粒度分类方法与系统。所述方法包括:从文本中识别出实体;将识别出的实体、知识库中与其相关的实体以及相关实体在知识库中的分类作为结点构建依赖图,其中依赖图中的边的权值表示该边连接的两个结点之间的相关程度;以及,通过在所述依赖图上执行重启动随机游走,得到识别出的实体所属的分类。本发明能够克服现有技术在实体上下文缺乏的情况下难以实现对该实体进行细粒度分类的缺陷,并且提高了实体细粒度分类的准确率。 | ||
搜索关键词: | 一种 面向 知识库 更新 实体 细粒度 分类 方法 系统 | ||
【主权项】:
1.一种面向知识库更新的实体细粒度分类方法,包括:步骤1)、从文本中识别出实体;步骤2)、将识别出的实体、知识库中与其相关的实体以及相关实体在知识库中的分类作为结点构建依赖图,其中依赖图中的边的权值表示该边连接的两个结点之间的相关程度;所述步骤2)进一步包括:步骤21)、根据语义相容度获得识别出的实体在知识库中的相关实体,并且获得该相关实体在知识库中的分类;其中,语义相容度表示识别出的实体的上下文信息与相关实体的描述文本的相似度;步骤22)、将识别出的实体、知识库中与其相关的实体以及相关实体在知识库中的分类作为结点;步骤23)、在表示识别出的实体的结点和表示相关实体的结点之间添加边,边的权值为该识别出的实体与该相关实体之间的语义相容度;在表示相关实体的结点和表示分类的结点之间添加边,边的权值指示该相关实体是否属于该分类;在表示相关实体的结点之间添加边,边的权值为该相关实体之间的语义相关度;在表示分类的结点之间添加边,边的权值为该分类之间的相关度;步骤3)、通过在所述依赖图上执行重启动随机游走,得到识别出的实体所属的分类。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于中国科学院计算技术研究所,未经中国科学院计算技术研究所许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201510033050.4/,转载请声明来源钻瓜专利网。