HBase与Hive对比
Hive
- 数据仓库
Hive的本质其实就相当于HDFS中已经存储的文件在MySql中做了一个双射关系,以方便使用HQL去管理查询。
- 用于数据分析、清洗
Hive适用于离线的数据分析和清洗,延迟较高。
- 基于HDFS、MapReduce
Hive存储的数据依旧在DataNode上,编写的HQL语句终将是转换为MapReduce代码执行。
HBase
- 数据库
是一种面向列族的非关系型数据库。
- 用于存储结构化和非结构化的数据
适用于单列表非关系型数据的存储,不适合做关联查询,类似Jion等操作。
- 基于HDFS
数据持久化存储的体现形式是HFile,存放于DataNode中,被ResionServer以region的形式进行管理。
- 延迟较低,接入在线业务使用
面对大量的企业数据,HBase可以直接单表大量数据的存储,同时提供高效的数据访问速度。
作者:Jace Jin
github地址:https://github.com/buxianghua
原创文章版权归作者所有.
欢迎转载,转载时请在文章页面明显位置给出原文连接,否则保留追究法律责任的权利.
欢迎转载,转载时请在文章页面明显位置给出原文连接,否则保留追究法律责任的权利.