为什么hdfs不适合存储小文件?
1.小文件数量过多(例如图片)会占用批量占用namenode的内存,浪费block
因为每个储存在HDFS中的文件的元数据(包括目录树,位置信息,命名空间镜像,文件编辑信息)
都会在namenode中占用150b的内存,如果namenode存储空间满了,就不能继续存储新文件了。
2.如果有多小文件,会造成寻道时间>=读取文件时间(传输文件时间=寻道时间+读取文件时间),
这与HDFS的原理想违背,hdfs的设计是为了减小寻道时间,使其远小于读取文件的时间。
1.小文件数量过多(例如图片)会占用批量占用namenode的内存,浪费block
因为每个储存在HDFS中的文件的元数据(包括目录树,位置信息,命名空间镜像,文件编辑信息)
都会在namenode中占用150b的内存,如果namenode存储空间满了,就不能继续存储新文件了。
2.如果有多小文件,会造成寻道时间>=读取文件时间(传输文件时间=寻道时间+读取文件时间),
这与HDFS的原理想违背,hdfs的设计是为了减小寻道时间,使其远小于读取文件的时间。