作者:林伟 柳荣其 徐熙邮件过滤特征选择信息增益chi统计聚类
摘要:特征选择是基于内容的垃圾邮件过滤的重要过程,它有效地改善过滤效率和精度。文中分析了IG和CHI应用到垃圾邮件过滤中存在的不足,设计了一种改进的评价函数。而由于这种评价函数的特征选择方法只度量了特征与类的关系,忽略了特征之间依赖的关系,因此进一步用基于互信息的聚类方法来消除特征间冗余。实验结果表明该特征选择方法有效地提高了邮件过滤的性能。
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社
《计算机技术与发展》(CN:61-1450/TP)是一本有较高学术价值的大型月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。 《计算机技术与发展》在国内外有广泛的覆盖面,国内读者遍布全国32个省(市、自治区)以及港、澳、台地区,境外读者分布在北美、西欧、韩国、日本等38个国家和地区。
部级期刊
人气 230965 评论 65
人气 216790 评论 35
省级期刊
人气 214071 评论 71
北大期刊、统计源期刊
人气 193654 评论 73