摘要:聚类算法作为机器学习领域的一个至关重要的算法体系,已经被深入研究和广泛使用了很多年,其主要研究内容集中在用相似距离作为依据,其中Kmeans算法应用极为广泛,被添加到各种数据挖掘软件包中.传统的Kmeans算法不能满足今天大数据环境下的应用,文中利用Spark技术将其改进为并行化的设计思想并进行优化.
分类:期刊> 自然科学与工程技术> 基础科学> 基础科学综合
收录:维普收录(中) > 知网收录(中) > 万方收录(中) > 上海图书馆馆藏 > 国家图书馆馆藏
关键词:kmeans算法 spark 并行化 优化
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社