hive索引机制和原理

hive索引介绍 Hive的索引目的是提高Hive表指定列的查询速度。  没有索引时,类似’WHERE tab1.col1 = 10’ 的查询,Hive会加载整张表或分区,然后处理所有的rows,  但是如果在字段col1上面存在索引时,那么只会加载和处理文件的一部分。  与其他传统数据库一样,增加索引在提升查询速度时,会消耗额外资源去创建索引和需要更多的磁盘空间存储索引。  Hive 0.7.0
相关文章
相关标签/搜索