摘要: 1. 背景 近日帮外部门的同事处理一个小需求,就是将HDFS中2018年至今所有存储的sequence序列化文件读取出来,重新保存成文本格式,以便于他后续进行处理。由于同事主要做机器学习方向,对hadoop或spark方面不了解,所以我就想着这么小的需求,简单支持下即可,花个几分钟写了一个脚本提供给 阅读全文
posted @ 2018-04-08 22:01 mengrennwpu 阅读(1498) 评论(0) 推荐(1) 编辑