博客园 首页 私信博主 显示目录 隐藏目录 管理 动画

为什么hdfs不适合存储小文件?


1.小文件数量过多(例如图片)会占用批量占用namenode的内存,浪费block
因为每个储存在HDFS中的文件的元数据(包括目录树,位置信息,命名空间镜像,文件编辑信息)

都会在namenode中占用150b的内存,如果namenode存储空间满了,就不能继续存储新文件了。
2.如果有多小文件,会造成寻道时间>=读取文件时间(传输文件时间=寻道时间+读取文件时间),

这与HDFS的原理想违背,hdfs的设计是为了减小寻道时间,使其远小于读取文件的时间。

posted @ 2022-05-29 19:18  CHANG_09  阅读(344)  评论(0编辑  收藏  举报