摘要: 1. Reduce端连接 Map端的主要工作:为来自不同表(文件)的key/value对打标签以区别不同来源的记录。然后用连接字段作为key,其余部分和新加的标志作为value,最后进行输出。reduce端的主要工作:在reduce端以连接字段作为key的分组已经完成,我们只需要在每一个分组当中将那 阅读全文
posted @ 2017-10-17 22:11 清泉*** 阅读(756) 评论(0) 推荐(0) 编辑