[发明专利]自动识别文本的文体结构的方法及装置无效

专利信息
申请号: 98811864.5 申请日: 1998-10-15
公开(公告)号: CN1127030C 公开(公告)日: 2003-11-05
发明(设计)人: 西蒙·科斯通;米格尔·卡多索·德坎普斯 申请(专利权)人: 微软公司
主分类号: G06F17/27 分类号: G06F17/27
代理公司: 中科专利商标代理有限责任公司 代理人: 戎志敏
地址: 暂无信息 国省代码: 暂无信息
权利要求书: 查看更多 说明书: 查看更多
摘要: 发明针对识别文本的文体结构。在优选实施例中,文体结构识别功能程序例用与文本有关的语法信息,产生一个表征文本文体结构的文体结构树。功能程序首先在文本中识别从句的号码。然后,对每一个区别的从句对,根据有关的从句对的文本语法结构和语义,功能程序确定可能的文体关系的那一个号码将在从句对之间被假定。然后,功能程序应用假定的关系到该从句,以便产生一个表征文本的文体结构的文体结构树。在某些实施例中,功能程序从产生的文体结构树中还产生一个反映了作者追求的最初目标的文本的提要。
搜索关键词: 自动识别 文本 文体 结构 方法 装置
【主权项】:
1.一种自动识别文本的文体结构的方法,在计算机系统中,确定定量的得分用于反映似然性的文体结构树,以致文体结构树正确地表征包括从句的文本的文体结构,文体结构树包括代表从句的节点,节点包括终端节点和非终端节点,每一个非终端节点识别两个或多个子节点之间的假定的文体关系,只有一个节点是根节点并且该根节点不是任何节点的子节点,方法包括步骤:对每一个非终端节点:确定得分用于反映似然性的当前节点所代表的假定关系,以致文体关系在当前节点的子节点所代表的从句之间被正确地识别,组合具有当前节点所代表的文体关系得分的任何非终端子节点的得分,以及,组合的得分归属到当前的节点;以及把根节点的得分归属到文体结构树。。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。

该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于微软公司,未经微软公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服

本文链接:http://www.vipzhuanli.com/patent/98811864.5/,转载请声明来源钻瓜专利网。

×

专利文献下载

说明:

1、专利原文基于中国国家知识产权局专利说明书;

2、支持发明专利 、实用新型专利、外观设计专利(升级中);

3、专利数据每周两次同步更新,支持Adobe PDF格式;

4、内容包括专利技术的结构示意图流程工艺图技术构造图

5、已全新升级为极速版,下载速度显著提升!欢迎使用!

请您登陆后,进行下载,点击【登陆】 【注册】

关于我们 寻求报道 投稿须知 广告合作 版权声明 网站地图 友情链接 企业标识 联系我们

钻瓜专利网在线咨询

周一至周五 9:00-18:00

咨询在线客服咨询在线客服
tel code back_top