首页> 中文期刊> 《计算机系统应用》 >基于联合分类器过滤噪声的微博主题发现

基于联合分类器过滤噪声的微博主题发现

         

摘要

With the popularity of the Internet, microblogging as a representative of the social network has generated a lot of data. Exploring useful information from these data has become an important direction for today's research. According to the characteristics of microblogging text, this paper presents a method based on joint classifier to filter out noise microblogging, and then uses LDA model for subject discovery. The joint classifier model is composed of naive Bayesian, support vector machine and decision tree. The accuracy of the combined classifier is 87%, which can clearly show that this classification method is feasible and effective.%伴随着互联网的广泛流行,以微博为代表的社交网络产生了大量的数据.从这些数据中挖掘到有用的信息成为当今研究的一项重要方向.根据微博文本的特点,本文提出来一种基于联合分类器过滤掉噪声微博,然后利用LDA模型进行主题发现.联合分类器模型是由朴素贝叶斯、支持向量机和决策树三种模型通过简单投票机制结合构成的,实验结果联合分类器的准确度达到87%,显然这种分类方法是可行的,也是有效的.

著录项

  • 来源
    《计算机系统应用》 |2018年第1期|132-136|共5页
  • 作者单位

    中国科学院 合肥物质科学研究院 智能机械研究所;

    合肥 230031;

    中国科学技术大学;

    合肥 230026;

    中国科学院 合肥物质科学研究院 智能机械研究所;

    合肥 230031;

    中国科学院 合肥物质科学研究院 智能机械研究所;

    合肥 230031;

    中国科学院 合肥物质科学研究院 智能机械研究所;

    合肥 230031;

    中国科学院 合肥物质科学研究院 智能机械研究所;

    合肥 230031;

  • 原文格式 PDF
  • 正文语种 chi
  • 中图分类
  • 关键词

    支持向量机; 朴素贝叶斯; 决策树; 联合分类器; LDA模型;

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号