[发明专利]自动识别文本的文体结构的方法及装置无效
申请号: | 98811864.5 | 申请日: | 1998-10-15 |
公开(公告)号: | CN1127030C | 公开(公告)日: | 2003-11-05 |
发明(设计)人: | 西蒙·科斯通;米格尔·卡多索·德坎普斯 | 申请(专利权)人: | 微软公司 |
主分类号: | G06F17/27 | 分类号: | G06F17/27 |
代理公司: | 中科专利商标代理有限责任公司 | 代理人: | 戎志敏 |
地址: | 暂无信息 | 国省代码: | 暂无信息 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明针对识别文本的文体结构。在优选实施例中,文体结构识别功能程序例用与文本有关的语法信息,产生一个表征文本文体结构的文体结构树。功能程序首先在文本中识别从句的号码。然后,对每一个区别的从句对,根据有关的从句对的文本语法结构和语义,功能程序确定可能的文体关系的那一个号码将在从句对之间被假定。然后,功能程序应用假定的关系到该从句,以便产生一个表征文本的文体结构的文体结构树。在某些实施例中,功能程序从产生的文体结构树中还产生一个反映了作者追求的最初目标的文本的提要。 | ||
搜索关键词: | 自动识别 文本 文体 结构 方法 装置 | ||
【主权项】:
1.一种自动识别文本的文体结构的方法,在计算机系统中,确定定量的得分用于反映似然性的文体结构树,以致文体结构树正确地表征包括从句的文本的文体结构,文体结构树包括代表从句的节点,节点包括终端节点和非终端节点,每一个非终端节点识别两个或多个子节点之间的假定的文体关系,只有一个节点是根节点并且该根节点不是任何节点的子节点,方法包括步骤:对每一个非终端节点:确定得分用于反映似然性的当前节点所代表的假定关系,以致文体关系在当前节点的子节点所代表的从句之间被正确地识别,组合具有当前节点所代表的文体关系得分的任何非终端子节点的得分,以及,组合的得分归属到当前的节点;以及把根节点的得分归属到文体结构树。。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于微软公司,未经微软公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/98811864.5/,转载请声明来源钻瓜专利网。
- 上一篇:龙眼低温硫处理护色保鲜方法
- 下一篇:一种药物牙膏及其制备方法