2020年1月31日
摘要: 1.基于内存2.迭代式计算3.分布式 基本工作原理:将spark的程序提交到spark集群上,在Hadoop的HDFS或者Hive上读取数据,读取的数据存放在各个spark的节点上,分布式的存放在多个节点上,主要在每个节点的内存上,这样可以加快速度。对节点的数据进行处理,处理后的数据存放在其他的节点 阅读全文
posted @ 2020-01-31 13:47 啥123 阅读(325) 评论(0) 推荐(0) 编辑