摘要:
1.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 2.编写map与reduce函数 3.本地测试map与reduce 4.将文本数据上传至HDFS上 阅读全文
摘要:
1.本地文件系统创建一个文件,输入带姓名学号信息。 2.查看新建文件所在目录 3.查看新建文件内容 4.将此文件上传到HDFS文件系统上的用户目录 5.HDFS上查看相应目录 6.HDFS上查看文件内容 7.HDFS上查看文件大小 8.删除本地1步骤创建的文件 9.将HDFS上的文件下载到本地 10 阅读全文
摘要:
1.用自己的图,描述HDFS体系结构、工作原理与流程。 2.伪分布式安装Hadoop。 阅读全文
摘要:
问题一:了解对比Hadoop不同版本的特性,可以用图表的形式呈现 答: 发行版本 功能特点 DKhadoop发行版 DKhadoop发行版:有效的集成了整个HADOOP生态系统的全部组件,并深度优化,重新编译为一个完整的更高性能的大数据通用计算平台,实现了各部件的有机协调。因此DKH相比开源的大数据 阅读全文
摘要:
问题一:了解微信、微博、小视频每天产生的数据量与数据类型。答:目前微博每天可能产生4亿+的数据量,数据类型为string,微信每天可能有450亿的消息发送,数据类型为string,小视频每天有上千万的小视频,数据类型为string;问题二:选择一个你感兴趣的领域应用数据思维进行分析决策的案例。答:@ 阅读全文