计算机工程与应用 ›› 2009, Vol. 45 ›› Issue (22): 53-55.DOI: 10.3778/j.issn.1002-8331.2009.22.018
陈艳秋,熊耀华
CHEN Yan-qiu,XIONG Yao-hua
摘要: 为了提高中文文本分类的效率与精度,设计了一种新型的分类器。该分类器采用基于词频、互信息和类别信息的综合评估函数进行选择特征;在特征权重计算上,由于传统TF-IDF方法没有考虑特征类间和类内分布,提出了一种将词频和综合评估函数值相结合的权重计算方法;最后设计了一种基于贝叶斯原理的快速分类器。实验证明该分类器简单有效。