基于Spark Streaming的在线KMeans聚类模型研究

作者：侯敬儒; 吴晟; 李英娜mapreducesparkstreaming在线计算低延迟

摘要：针对基于MapReduce框架处理海量数据实时响应能力较差的问题,设计并实现了基于Spark Streaming的在线计算模型进行大规模的KMeans聚类分析。该模型将整个过程分为数据接入、在线训练等模块,各模块通过数据流连通形成任务实体,提交到Spark分布式集群运行完成。通过比对分析实验和性能检测,验证了该在线KMeans聚类模型具有高吞吐、低延迟的优势,且集群运行状况良好。

注：因版权方要求，不能公开全文，如需全文，请咨询杂志社

学术咨询在线咨询

计算机与数字工程

《计算机与数字工程》（CN：42-1372/TP）是一本有较高学术价值的大型月刊，自创刊以来，选题新奇而不失报道广度，服务大众而不失理论高度。颇受业界和广大读者的关注和好评。《计算机与数字工程》始终秉承:"坚持理论联系实际;坚持实事求是的学风;坚持以应用为主,提高与普及并重;坚持创新;坚持以刊登国内外计算机方面的新理论,新技术,新工艺,新成果研究为主;以学术性,技术性为办刊宗旨。

杂志详情

服务推荐

计算机与数字工程相关期刊

基于Spark Streaming的在线KMeans聚类模型研究

服务推荐

在线咨询

杂志订阅

期刊推荐

数字技术与应用

网友世界

计算机光盘软件与应用

计算机与网络