08 2018 档案

摘要:1.概述 在进行数据传输中,批量加载数据到HBase集群有多种方式,比如通过HBase API进行批量写入数据、使用Sqoop工具批量导数到HBase集群、使用MapReduce批量导入等。这些方式,在导入数据的过程中,如果数据量过大,可能耗时会比较严重或者占用HBase集群资源较多(如磁盘IO、H 阅读全文
posted @ 2018-08-19 17:29 哥不是小萝莉 阅读(37194) 评论(0) 推荐(4) 编辑
摘要:1.概述 在《HBase查询优化》一文中,介绍了基于HBase层面的读取优化。由于HBase的实际数据是以HFile的形式,存储在HDFS上。那么,HDFS层面也有它自己的优化点,即:Short-Circuit Local Reads。本篇博客笔者将从HDFS层面来进行优化,从而间接的提升HBase 阅读全文
posted @ 2018-08-12 13:45 哥不是小萝莉 阅读(4437) 评论(0) 推荐(2) 编辑
摘要:1.概述 HBase是一个实时的非关系型数据库,用来存储海量数据。但是,在实际使用场景中,在使用HBase API查询HBase中的数据时,有时会发现数据查询会很慢。本篇博客将从客户端优化和服务端优化两个方面来介绍,如何提高查询HBase的效率。 2.内容 这里,我们先给大家介绍如何从客户端优化查询 阅读全文
posted @ 2018-08-05 13:54 哥不是小萝莉 阅读(22735) 评论(2) 推荐(3) 编辑

点击右上角即可分享
微信分享提示