2018年4月1日
摘要: RDD是啥?(摘自词条) RDD(Resilient Distributed Datasets) ,弹性分布式数据集, 是分布式内存的一个抽象概念,RDD提供了一种高度受限的共享内存模型,即RDD是只读的记录分区的集合,只能通过在其他RDD执行确定的转换操作(如map、join和group by)而 阅读全文
posted @ 2018-04-01 23:39 菜小小 阅读(248) 评论(1) 推荐(0) 编辑