Spark日志清洗

   日志数据清洗,主要采用spark 的定时任务,清洗出有效数据,并保存到hive数据仓库中存储。常用流程如下:

参考:https://gaojianhua.gitbooks.io/bigdata-wiki/content/sparkclean.html

posted @   moonandstar08  阅读(1573)  评论(0编辑  收藏  举报
努力加载评论中...
点击右上角即可分享
微信分享提示