摘要:大数据环境下,网络安全事件层出不穷,网络安全成为各界关注的热点. 安全日志记录着设备运行状态的重要信息,通过对其分析可以实时掌握网络安全态势,可作为事前防护、事后追责的安全审计手段,实现对异常事件的追责与溯源.针对日 志审计的重要性并结合数据挖掘在日志分析领域的重要作用,同时针对单机环境下处 理海量数据效率相对滞后等问题,文章提出一种基于Hadoop的面向海量安全日志的 聚类算法.首先,文章提出了基于最大最小距离( MMD ) 和均值思想对K-means聚 类算法进行改进,克服了传统尤-means聚类算法在寻找初始聚类中心随机性的缺陷; 其次,为了适应海量数据的有效处理,提高聚类的效率与速度,将改进的尤-means聚 类算法部署在Map/Reduce上进行迭代计算.实验表明,改进的聚类算法的准确性优 于其他典型算法,聚类效果稳定,在集群的性能上具有较好的运行速度和加速比.
分类:期刊> 自然科学与工程技术> 信息科技> 互联网技术
收录:北大期刊(中国人文社会科学期刊) > CSCD 中国科学引文数据库来源期刊(含扩展版) > 统计源期刊(中国科技论文优秀期刊) > 知网收录(中) > 维普收录(中) > 万方收录(中) > 国家图书馆馆藏 > 上海图书馆馆藏
关键词:安全日志 聚类 hadoop
注:因版权方要求,不能公开全文,如需全文,请咨询杂志社