HI,欢迎来到学术之家,发表咨询:400-888-7501  订阅咨询:400-888-7502  股权代码  102064
0

一种基于模糊C-均值聚类的欠采样集成不平衡数据分类算法

作者:肖连杰; 郜梦蕊; 苏新宁不平衡数据分类欠采样集成学习

摘要:【目的】解决二分类任务中因类间数据不平衡导致少数类分类准确度低的问题。【方法】提出一种基于模糊C-均值聚类的欠采样集成不平衡数据分类算法(ECFCM),即对多数类样本进行基于FCM聚类的欠采样,将聚类中心样本与全部少数类样本组成平衡数据集;利用基于Bagging的集成学习算法对平衡数据集进行分类。【结果】在4组不平衡数据集上的Matlab仿真实验结果表明,ECFCM算法的Acc、AUC和F1提升幅度最高为5.75%(Spambase),13.84%(Glass2)和7.54%(Spambase)。【局限】本文采用标准数据集验证ECFCM算法的有效性,当采用实际应用中的不平衡数据时,需要有针对性地研究不平衡数据分类算法。【结论】ECFCM算法分类性能良好,在一定程度上有利于提高不平衡数据中少数类的分类准确度。

注:因版权方要求,不能公开全文,如需全文,请咨询杂志社

数据分析与知识发现

《数据分析与知识发现》(CN:10-1478/G2)是一本有较高学术价值的大型月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。 《数据分析与知识发现》内容定位于广泛吸纳计算机科学、数据科学、情报科学以及数字科研、数字教育和数字文化等领域的技术与方法,研究数据驱动的语义计算、内容分析、数据挖掘、知识发现、智能管理和决策支持等方面的技术、方法、系统以及支撑设施、政策与机制等,尤其是聚焦从海量、异构、分布、动态、甚至富媒体数据中挖掘和发现知识以支持研究、管理和决...

杂志详情