作者:刘海峰 苏展 刘守生文本分类特征选择类内分布类间分布
摘要:CHI是一种常用的文本特征选择方法。针对该模型的不足之处,以特征项的频数为依据,分别从特征项的类内分布、类间分布以及类内不同文本之间分布等角度,对CHI模型进行逐步优化,使得特征项频数信息得到了有效利用。提出了一种基于词频信息的改进CHI模型。随后的文本分类试验证明了提出优化CHI模型的有效性。
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社
《计算机工程与应用》(CN:11-2127/TP)是一本有较高学术价值的大型半月刊,自创刊以来,选题新奇而不失报道广度,服务大众而不失理论高度。颇受业界和广大读者的关注和好评。
部级期刊
人气 230386 评论 65
人气 215068 评论 35
省级期刊
人气 213319 评论 71
北大期刊、统计源期刊
人气 193087 评论 73