上一页 1 2 3 4 5 6 7 ··· 11 下一页

2014年6月29日

摘要: 欢迎转载,转载请注明出处,徽沪一郎。概要Hadoop2中的Yarn是一个分布式计算资源的管理平台,由于其有极好的模型抽象,非常有可能成为分布式计算资源管理的事实标准。其主要职责将是分布式计算集群的管理,集群中计算资源的管理与分配。Yarn为应用程序开发提供了比较好的实现标准,Spark支持Yarn部... 阅读全文
posted @ 2014-06-29 17:20 虚若怀谷 阅读(309) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。楔子在Spark源码走读系列之2中曾经提到Spark能以Standalone的方式来运行cluster,但没有对Application的提交与具体运行流程做详细的分析,本文就这些问题做一个比较详细的分析,并且对在standalone模式下如何实现HA进行讲解。没有... 阅读全文
posted @ 2014-06-29 17:18 虚若怀谷 阅读(304) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。楔子Spark计算速度远胜于Hadoop的原因之一就在于中间结果是缓存在内存而不是直接写入到disk,本文尝试分析Spark中存储子系统的构成,并以数据写入和数据读取为例,讲述清楚存储子系统中各部件的交互关系。存储子系统概览上图是Spark存储子系统中几个主要模块... 阅读全文
posted @ 2014-06-29 17:17 虚若怀谷 阅读(258) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎,谢谢。在流数据的处理过程中,为了保证处理结果的可信度(不能多算,也不能漏算),需要做到对所有的输入数据有且仅有一次处理。在Spark Streaming的处理机制中,不能多算,比较容易理解。那么它又是如何作到即使数据处理结点被重启,在重启之后这些数据也会被再次处理... 阅读全文
posted @ 2014-06-29 17:14 虚若怀谷 阅读(248) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。Spark Streaming能够对流数据进行近乎实时的速度进行数据处理。采用了不同于一般的流式数据处理模型,该模型使得Spark Streaming有非常高的处理速度,与storm相比拥有更高的吞能力。本篇简要分析Spark Streaming的处理模型,Spa... 阅读全文
posted @ 2014-06-29 17:13 虚若怀谷 阅读(383) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。概要本篇主要阐述在TaskRunner中执行的task其业务逻辑是如何被调用到的,另外试图讲清楚运行着的task其输入的数据从哪获取,处理的结果返回到哪里,如何返回。准备spark已经安装完毕spark运行在local mode或local-cluster mod... 阅读全文
posted @ 2014-06-29 17:11 虚若怀谷 阅读(329) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。概要本文以wordCount为例,详细说明spark创建和运行job的过程,重点是在进程及线程的创建。实验环境搭建在进行后续操作前,确保下列条件已满足。下载spark binary 0.9.1安装scala安装sbt安装java启动spark-shell单机模式运... 阅读全文
posted @ 2014-06-29 17:07 虚若怀谷 阅读(278) 评论(0) 推荐(0) 编辑
摘要: 欢迎转载,转载请注明出处,徽沪一郎。楔子源码阅读是一件非常容易的事,也是一件非常难的事。容易的是代码就在那里,一打开就可以看到。难的是要通过代码明白作者当初为什么要这样设计,设计之初要解决的主要问题是什么。在对Spark的源码进行具体的走读之前,如果想要快速对Spark的有一个整体性的认识,阅读Ma... 阅读全文
posted @ 2014-06-29 17:02 虚若怀谷 阅读(278) 评论(0) 推荐(0) 编辑

2014年6月20日

摘要: Spark已正式申请加入Apache孵化器,从灵机一闪的实验室“电火花”成长为大数据技术平台中异军突起的新锐。本文主要讲述Spark的设计思想。Spark如其名,展现了大数据不常见的“电光石火”。具体特点概括为“轻、快、灵和巧”。轻:Spark 0.6核心代码有2万行,Hadoop 1.0为9万行,... 阅读全文
posted @ 2014-06-20 16:54 虚若怀谷 阅读(811) 评论(0) 推荐(0) 编辑

2014年6月13日

摘要: 声明:1)该博文是整理自网上很大牛和专家所无私奉献的资料的。具体引用的资料请看参考文献。具体的版本声明也参考原文献2)本文仅供学术交流,非商用。所以每一部分具体的参考资料并没有详细对应,更有些部分本来就是直接从其他博客复制过来的。如果某部分不小心侵犯了大家的利益,还望海涵,并联系老衲删除或修改,直到... 阅读全文
posted @ 2014-06-13 15:01 虚若怀谷 阅读(958) 评论(0) 推荐(0) 编辑
上一页 1 2 3 4 5 6 7 ··· 11 下一页

导航