【发布时间】:2015-06-09 05:07:05
【问题描述】:
我是 hive 和 hadoop 的新手,刚刚在 Hive 上创建了一个表(orc 文件格式)。我现在正在尝试在我的配置单元表(位图索引)上创建索引。每次我运行索引构建查询时,hive 都会启动一个 map reduce 作业来索引。在某些时候,我的 map reduce 作业只是挂起,并且我的一个节点(在多次重试中随机不同,因此它可能不是节点)失败。我尝试将我的mapreduce.child.java.opts 增加到 2048mb,但这给了我错误,因为我使用了比可用内存更多的内存,所以我将mapreduce.map.memory.mb 和 mapreduce.reduce.memory.mb 增加到 8GB。所有其他配置都保留为默认值。
如果我错过了哪些配置,我们将不胜感激。
仅出于上下文考虑,我正在尝试为具有 24 亿行的表建立索引,该表大小为 450GB,具有 3 个分区。
【问题讨论】:
标签: hadoop hive hadoop-yarn