基于遗传理论的改进数据过采样方法

丁胜夺; 赵刚; 阎红巧; 刘洪太

首页> 中文期刊> 《计算机系统应用》 >基于遗传理论的改进数据过采样方法

基于遗传理论的改进数据过采样方法

开具论文收录证明 >>

期刊封面封底目录下载 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

针对数据分类预测模型的生成中,高度不平衡的训练数据会大幅降低模型的性能,本文提出了一种改进的基于遗传思想的不平衡数据集过采样方法,该方法从生物染色体遗传理论中得到启发,利用近亲生成相似而又不完全相同的新实例来平衡多数类,在保证样本分布不变的前提下,减弱甚至消除不平衡数据对训练结果的偏差影响.最后,通过在公共数据集上的对比实验表明,该方法取得了更高的召回率及G-mean值,证明此改进方法行之有效,所生成模型的综合性能有所提高.

著录项

来源
《计算机系统应用》 |2022年第2期|185-190|共6页
作者
丁胜夺; 赵刚; 阎红巧; 刘洪太;
展开▼
作者单位

中国石油集团安全环保技术研究院有限公司;

北京102206;

展开▼
原文格式 PDF
正文语种 chi
中图分类计算技术、计算机技术;
关键词
过采样; 不平衡数据处理; 分类预测模型; 遗传理论;

相似文献

中文文献
外文文献
专利

1. 基于遗传算法改进的少数类样本合成过采样技术的非平衡数据集分类算法 [J] . 霍玉丹 ,谷琼 ,蔡之华 . 计算机应用 . 2015,第001期
2. 基于遗传算法的一种不平衡数据集采样方法GSA [J] . 张巡 ,黎平 ,刘萍 . 贵州科学 . 2018,第002期
3. 基于支持向量机的不平衡数据分类的改进欠采样方法 [J] . 赵自翔 ,王广亮 ,李晓东 . 中山大学学报（自然科学版） . 2012,第006期
4. 基于改进遗传算法的大数据中心资源分配方法 [J] . 梁同乐 ,王珊珊 . 信息通信 . 2021,第003期
5. 基于改进遗传算法的模糊测试数据生成方法研究 [J] . 薛峰 . 信息与电脑 . 2020,第012期
6. 基于模糊集和改进的D-S理论的数据融合方法 [C] . 罗蓉 ,孙东 ,邓勇 . 2006年航空试验测试技术学术交流会 . 2006
7. 基于不平衡数据的过采样和特征选择方法改进 [A] . 高小华 . 2021

基于遗传理论的改进数据过采样方法

摘要

著录项

相似文献

相关主题

期刊订阅