Mapreduce

1.MapReduce进程

一个完整的MapReduce程序在分布式运行时有三类实例进程:
(1)MrAppMaster:负责整个程序的过程调度及状态协调。
(2)MapTask:负责Map阶段的整个数据处理流程。
(3)ReduceTask:负责Reduce阶段的整个数据处理流程。

2.常用数据序列化类型

3.MapReduce的编程规范

用户编写的程序分成三个部分:Mapper、Reducer和Driver。

4.WordCount案例

posted @ 2021-01-15 17:41  triumph丶xs  阅读(54)  评论(0编辑  收藏  举报