数据降维及聚类算法在烟叶相似性分析中的应用

翟擎辰; 周园春; 宋秋成; 王建伟; 孟珍; 张艳玲

首页> 中文期刊> 《数据与计算发展前沿》 >数据降维及聚类算法在烟叶相似性分析中的应用

数据降维及聚类算法在烟叶相似性分析中的应用

开具论文收录证明 >>

期刊封面封底目录下载 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

【目的】为了对烟叶产地进行相似性度量和分类,并克服高维空间下距离度量失效的问题。【方法】文章通过方差权重法、主成分分析法及局部线性嵌入法三种方法对烟叶属性指标进行降维和筛选,使用经过特征降维后的数据相似性进行计算及K-means聚类分析。【结果】通过分析不同方法所得输入指标的聚类的轮廓系数发现,方差权重法所筛选出的总植物碱、还原糖、钾、含梗率四个指标的聚类效果较两种降维算法所得的指标的聚类效果更好,对烟叶质量评估有较强的参考价值。K-means聚类算法将烟叶产区分为四类并且得到各类中属性特点,通过相似性算法所得到的结果在以麒麟区、宣威县、罗平县为代表的县区的相似性产地上与业内现有研究相互验证。【结论】文章基于机器学习算法,通过数据挖掘得到烟叶感官数据中的特征性指标与产地之间的相似性特点,为烟叶工业生产提供了具有一定参考价值的指标与结论,也为机器学习在烟草工业中的应用提供了算法基础。

著录项

来源
《数据与计算发展前沿》 |2021年第1期|P.112-121|共10页
作者
翟擎辰; 周园春; 宋秋成; 王建伟; 孟珍; 张艳玲;
展开▼
作者单位

中国科学院计算机网络信息中心北京100190中国科学院大学北京100049;

中国科学院计算机网络信息中心北京100190;

中国科学院计算机网络信息中心北京100190;

中国烟草总公司郑州烟草研究院河南郑州450001;

中国科学院计算机网络信息中心北京100190;

中国科学院计算机网络信息中心北京100190;

展开▼
原文格式 PDF
正文语种 chi
中图分类计算技术、计算机技术;
关键词
数据挖掘; 相似性; 聚类; 烟叶;

相似文献

中文文献
外文文献
专利

1. 数据降维及聚类算法在烟叶相似性分析中的应用 [J] . 翟擎辰 ,周园春 ,宋秋成 . 数据与计算发展前沿 . 2021,第001期
2. 主成分分析法与核主成分分析法在机械噪声数据降维中的应用比较 [J] . 梁胜杰 ,张志华 ,崔立林 . 中国机械工程 . 2011,第001期
3. 基于人工免疫聚类算法的配电网故障状态相似性分析方法 [J] . 董文娜 ,王增平 ,赵乔 . 电力系统及其自动化学报 . 2021,第006期
4. 基于MapReduce的聚类算法相似性度量分析研究 [J] . 彭天昊 ,潘有顺 ,杨胜林 . 现代信息科技 . 2018,第011期
5. 基于MapReduce的聚类算法相似性度量分析研究 [J] . 彭天昊 ,潘有顺 ,杨胜林 . 现代信息科技 . 2018,第011期
6. 一种加窗数据降维方法在光谱分析中的应用 [C] . 刘建学 ,吴守一 . 中国园艺学会葡萄与葡萄酒分会首届学术年会 . 2004
7. 基于K-prototypes聚类算法及数据降维的研究 [A] . 顾嘉成 . 2021

数据降维及聚类算法在烟叶相似性分析中的应用

摘要

著录项

相似文献

相关主题

期刊订阅