会员
周边
新闻
博问
闪存
众包
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
心态决定高度!
博客园
首页
新随笔
联系
管理
订阅
2015年6月14日
hadoop 多表关联
摘要: Map端的主要工作:为来自不同表(文件)的key/value对打标签以区别不同来源的记录。然后用连接字段作为key,其余部分和新加的标志作为value,最后进行输出。reduce端的主要工作:在reduce端以连接字段作为key的分组已经完成,我们只需要在每一个分组当中将那些来源于不同文件的记录(在...
阅读全文
posted @ 2015-06-14 17:13 Star°流浪
阅读(174)
评论(0)
推荐(0)
2015年6月9日
关于 mahout factorize-movielens-1M.sh 执行
摘要: mahout 0.9 hadoop 1.2.1 新手上路 请多指教;需要运行 /examples/bin/factorize-movielens-1M.sh 即 ALS 推荐算法,数据集从movielens官网上下载根据脚本文件,首先需要 将ratings.csv文件 放置在hdfs 文件系统中(/...
阅读全文
posted @ 2015-06-09 20:56 Star°流浪
阅读(168)
评论(0)
推荐(0)
公告