摘要:聚类是数据挖掘研究领域的一种重要数据预处理方法,其目的是从无标签数据集中获得有价值数据集的内在分布结构,进而简化数据集的描述。历经几十年的研究,针对不同应用和数据特性已出现了干余种不同的聚类算法,但不同的聚类算法都有其特定的适用范围和不足。传统的聚类算法大致可分为划分聚类方法、层次聚类方法、密度聚类方法、网格聚类方法、模型聚类方法等。通过对传统聚类方法的回顾和总结,文章重点介绍了近年来出现的同步聚类算法、信念传播聚类算法和密度峰值聚类算法,并针对以上聚类算法的应用及发展方向进行了论述。
分类:期刊> 自然科学与工程技术> 信息科技> 计算机软件及计算机应用
收录:知网收录(中) > 万方收录(中)
关键词:数据挖掘 聚类 信念传播 同步聚类 密度峰值
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社