[发明专利]社交平台的UGC标签聚类方法和装置在审
申请号: | 201310626462.X | 申请日: | 2013-11-28 |
公开(公告)号: | CN103699573A | 公开(公告)日: | 2014-04-02 |
发明(设计)人: | 昝艳;张俊林 | 申请(专利权)人: | 微梦创科网络科技(中国)有限公司 |
主分类号: | G06F17/30 | 分类号: | G06F17/30 |
代理公司: | 北京市京大律师事务所 11321 | 代理人: | 张璐;方晓明 |
地址: | 100080 北京*** | 国省代码: | 北京;11 |
权利要求书: | 查看更多 | 说明书: | 查看更多 |
摘要: | 本发明公开了一种社交平台的UGC标签聚类方法和装置,该方法包括:从UGC标签中选取k个标签作为质心分别聚类到初始化的k个簇后,进行至少一次聚类以及质心的更新;其中,一次聚类以及质心的更新过程中:对未聚类的每个标签,计算该标签与各簇的相似度,若计算的相似度大于设定阈值,将该标签聚类到与之相似度最大的簇中;否则生成一个新的以该标签为质心的簇;统计本次聚类完成后得到的每个簇中的标签的个数,将标签个数小于第一数量阈值的簇解散后,针对剩余的每个簇,对于该簇中的每个标签,计算出该标签与该簇中的其它标签的相似度的和值;将该簇的质心更新为和值最大的标签。应用本发明,可提高聚类准确度以及运算速度。 | ||
搜索关键词: | 社交 平台 ugc 标签 方法 装置 | ||
【主权项】:
一种社交平台的UGC标签聚类方法,其特征在于,包括:从用户生成内容UGC标签中选取k个标签作为质心分别聚类到初始化的k个簇后,进行至少一次聚类以及质心的更新;其中,在一次聚类以及质心的更新过程中:对所述UGC标签中未聚类到簇中的每个标签,计算该标签与各簇的相似度,若计算的相似度大于设定阈值,则将该标签聚类到与之相似度最大的簇中;否则,生成一个新的簇,将该标签作为该新的簇的质心;对于本次聚类完成后所得到的每个簇,统计该簇的标签的个数;将标签的个数小于第一数量阈值的簇进行解散后,对于剩余的每个簇,进行该簇质心的更新:对于该簇中的每个标签,计算出该标签与该簇中的其它标签的相似度的和值;将该簇的质心更新为和值最大的标签。
下载完整专利技术内容需要扣除积分,VIP会员可以免费下载。
该专利技术资料仅供研究查看技术是否侵权等信息,商用须获得专利权人授权。该专利全部权利属于微梦创科网络科技(中国)有限公司,未经微梦创科网络科技(中国)有限公司许可,擅自商用是侵权行为。如果您想购买此专利、获得商业授权和技术合作,请联系【客服】
本文链接:http://www.vipzhuanli.com/patent/201310626462.X/,转载请声明来源钻瓜专利网。
- 上一篇:一种终端播放方法及系统
- 下一篇:一种实现产品供应链信息共享的方法及系统