会员
周边
众包
新闻
博问
闪存
赞助商
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
waker_wang
博客园
|
首页
|
新随笔
|
新文章
|
联系
|
订阅
|
管理
2018年8月27日
Hadoop参数调优
摘要: 转自:http://blog.sina.com.cn/s/blog_6a67b5c50100vop9.html dfs.block.size 决定HDFS文件block数量的多少(文件个数),它会间接的影响Job Tracker的调度和内存的占用(更影响内存的使用), mapred.map.task
阅读全文
posted @ 2018-08-27 16:13 waker_wang
阅读(1940)
评论(0)
推荐(0)
编辑
hive自定义函数(UDF)
摘要: 首先什么是UDF,UDF的全称为user-defined function,用户定义函数,为什么有它的存在呢?有的时候 你要写的查询无法轻松地使用Hive提供的内置函数来表示,通过写UDF,Hive就可以方便地插入用户写的处理代码并在查询中使用它们,相当于在HQL(Hive SQL)中自定义一些函数
阅读全文
posted @ 2018-08-27 15:46 waker_wang
阅读(976)
评论(0)
推荐(0)
编辑
HDFS优缺点
摘要: 1、之所以选择 HDFS 存储数据,是因为 HDFS 具有以下优点: (1) 高容错性 1) 数据自动保存多个副本。它通过增加副本的形式,提高容错性。 2) 某一个副本丢失以后,它可以自动恢复,这是由 HDFS 内部机制实现的,我们不必关心。 (2) 适合批处理 1) 它是通过移动计算而不是移动数据
阅读全文
posted @ 2018-08-27 11:44 waker_wang
阅读(10866)
评论(0)
推荐(0)
编辑
公告