[发明专利]文章情感分析方法和装置在审
申请号: | 202110986658.4 | 申请日: | 2021-08-26 |
公开(公告)号: | CN113688620A | 公开(公告)日: | 2021-11-23 |
发明(设计)人: | 杨林;雷思东 | 申请(专利权)人: | 北京阅神智能科技有限公司 |
主分类号: | G06F40/205 | 分类号: | G06F40/205;G06F40/30;G06F16/35;G06N3/04 |
代理公司: | 北京细软智谷知识产权代理有限责任公司 11471 | 代理人: | 葛钟 |
地址: | 100089 北京市海淀*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | |||
搜索关键词: | 文章 情感 分析 方法 装置 | ||
本发明涉及一种文章情感分析方法和装置。该方法包括:获取待分析文章;对待分析文章进行分句处理,得到组成待分析文章的所有句子;确定所有句子在待分析文章中的篇章要素分类结果和所有所述句子的情感极性;篇章要素分类结果用于表示对应所述句子在待分析文章中的作用;情感极性包括中性;计算所有所述情感极性为中性的句子在所有所述句子中的占比值,并将占比值定义为待分析文章的情感强度得分;根据所有句子在所述待分析文章中的篇章要素分类结果、所有句子的情感极性和各所述篇章要素分类结果对应的预设权重确定待分析文章的情感极性。本发明能够智能分析出文章的情感强度得分和情感极性,使得用户通过本发明能够快速了解文章的情感色彩。
技术领域
本发明涉及文章情感智能分析技术领域,具体涉及一种文章情感分析方法和装置。
背景技术
深度学习算法模型在自然语言处理领域的应用越来越广泛,基于深度学习的深层文本特征提取能力不断增强,使得在微博等领域出现了智能分析句子情感的模型。
然而,目前的情感分析模型只能针对单个句子进行智能情感分析,无法对像作文等文章进行智能情感分析。
发明内容
有鉴于此,提供一种文章情感分析方法和装置,以解决相关技术的情感分析模型无法对文章进行智能情感分析的问题。
本发明采用如下技术方案:
第一方面,本发明提供了一种文章情感分析方法,包括:
获取待分析文章;
对所述待分析文章进行分句处理,得到组成所述待分析文章的所有句子;
确定所有所述句子在所述待分析文章中的篇章要素分类结果和所有所述句子的情感极性;所述篇章要素分类结果用于表示对应所述句子在所述待分析文章中的作用;所述情感极性包括中性;
计算所有所述情感极性为中性的句子在所有所述句子中的占比值,并将所述占比值定义为所述待分析文章的情感强度得分;
根据所有所述句子在所述待分析文章中的篇章要素分类结果、所有所述句子的情感极性和各所述篇章要素分类结果对应的预设权重确定所述待分析文章的情感极性。
优选的,所述根据所有所述句子在所述待分析文章中的篇章要素分类结果、所有所述句子的情感极性和各所述篇章要素分类结果对应的预设权重确定所述待分析文章的情感极性,包括:
根据所述句子的情感极性将所有所述句子划分为不同组合,且使得每个组合中的句子情感极性相同;
将所述组合中各所述句子在所述待分析文章中的篇章要素分类结果对应的预设权重相加,得到所述组合对应的权重值;
确定所述权重值最高的组合所对应的情感极性为所述待分析文章的情感极性,其中,所述组合所对应的情感极性为所述组合中的句子的情感极性。
优选的,所述确定所有所述句子在所述待分析文章中的篇章要素分类结果和所有所述句子的情感极性之前,本发明的文章情感分析方法还包括:
获取多条待分类句子;所述待分类句子用于构成文章,且所述待分类句子对应的文章与所述待分析文章属于相同的领域;
确定各条所述待分类句子的情感极性;
将确定情感极性后的句子作为情感分类模型的训练数据;
根据所述训练数据训练所述情感分类模型;
所述确定所有所述句子的情感极性,包括:根据所述情感分类模型确定所有所述句子的情感极性。
优选的,所述确定各条所述待分类句子的情感极性之前,本发明的文章情感分析方法还包括:
获取微博领域情感分类数据集;
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于北京阅神智能科技有限公司,未经北京阅神智能科技有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/pat/books/202110986658.4/2.html,转载请声明来源钻瓜专利网。