摘要:针对KNN算法在中文文本分类时计算开销大的问题,在已有改进算法的基础上进行了更深入的研究,提出改进的基于中心向量KNN算法.算法首先引入基于密度的思想对训练样本进行调整,同时计算各类别的类中心向量.在保证类中心向量准确性的前提条件下,使分类阶段的复杂计算提前到分类器的训练过程中.实验结果表明,该算法在不损失精确度的情况下,提高了分类实时性.
分类:期刊> 自然科学与工程技术> 基础科学> 自然科学理论与方法
收录:知网收录(中) > 维普收录(中) > 万方收录(中) > CA 化学文摘(美) > 国家图书馆馆藏 > 上海图书馆馆藏
关键词:文本分类 多级分类器 类中心向量
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社