摘要: 1.下载喜欢的电子书或大量文本数据,并保存在本地文本文件中 2.编写map与reduce函数 3.本地测试map与reduce 4.将文本数据上传至HDFS上 阅读全文
posted @ 2020-11-13 20:06 吴大叔 阅读(73) 评论(0) 推荐(0) 编辑
摘要: 1.本地文件系统创建一个文件,输入带姓名学号信息。 2.查看新建文件所在目录 3.查看新建文件内容 4.将此文件上传到HDFS文件系统上的用户目录 5.HDFS上查看相应目录 6.HDFS上查看文件内容 7.HDFS上查看文件大小 8.删除本地1步骤创建的文件 9.将HDFS上的文件下载到本地 10 阅读全文
posted @ 2020-10-24 16:42 吴大叔 阅读(119) 评论(0) 推荐(0) 编辑
摘要: 1.用自己的图,描述HDFS体系结构、工作原理与流程。 2.伪分布式安装Hadoop。 阅读全文
posted @ 2020-10-20 21:03 吴大叔 阅读(97) 评论(0) 推荐(0) 编辑
摘要: 1. 熟悉 Linux系统的使用 阅读全文
posted @ 2020-10-10 20:53 吴大叔 阅读(123) 评论(0) 推荐(0) 编辑
摘要: 问题一:了解对比Hadoop不同版本的特性,可以用图表的形式呈现 答: 发行版本 功能特点 DKhadoop发行版 DKhadoop发行版:有效的集成了整个HADOOP生态系统的全部组件,并深度优化,重新编译为一个完整的更高性能的大数据通用计算平台,实现了各部件的有机协调。因此DKH相比开源的大数据 阅读全文
posted @ 2020-09-19 17:03 吴大叔 阅读(114) 评论(0) 推荐(0) 编辑
摘要: 问题一:了解微信、微博、小视频每天产生的数据量与数据类型。答:目前微博每天可能产生4亿+的数据量,数据类型为string,微信每天可能有450亿的消息发送,数据类型为string,小视频每天有上千万的小视频,数据类型为string;问题二:选择一个你感兴趣的领域应用数据思维进行分析决策的案例。答:@ 阅读全文
posted @ 2020-09-12 20:59 吴大叔 阅读(232) 评论(0) 推荐(0) 编辑