首页 | 本学科首页   官方微博 | 高级检索  
     

PWSWE:个人微博主题词提取算法的研究
作者单位:;1.内蒙古科技大学信息工程学院
摘    要:在分析传统短文本主题词提取算法的基础上,综合考虑个人微博的非主流文本特征,提出一种个人微博主题词提取算法PWSWE(Personal weibo subject word extraction algorithm)。该算法采用增量式的提取模式,首先引进由微博转帖、评论和赞数组成的流行度概念;其次对耦合、时序和流行度进行串行相似度计算;再次针对关键词特征值离散现象,对传统TF-IDF函数进行改进;最后综合以上提取结果并进行相应地处理得到最终的主题词。实验结果证明该算法提取的主题词具有较高的准确率和覆盖率。

关 键 词:个人微博  主题词  PWSWE

PWSWE: RESEARCH ON PERSONAL MICROBLOGGING SUBJECT WORDS EXTRACTION ALGORITHM
Abstract:
Keywords:
本文献已被 万方数据 等数据库收录!
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号