首页> 中文期刊>计算机科学 >基于Hellinger距离的混合数据集中分类变量相似度分析

基于Hellinger距离的混合数据集中分类变量相似度分析

     

摘要

分类变量的相似度分析是数据挖掘任务中的一个重要环节,现有的分类变量相似度算法中存在忽视变量差异、受不均衡分布影响严重、无法应用于混合数据集等缺点.为克服以上缺点,提出了一种基于Hellinger距离的分类变量相似度算法.该算法累加分类变量对应子集中不同属性变量的分布差异作为相似度,且支持混合数据集.将所提算法代入聚类算法并应用于UCI公共数据集,结果表明,该算法在准确度、有效性和稳定性上都有较大提高.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号