【问题标题】:Hadoop keeps on writing mapred intermediate outuput in /tmp directoryHadoop 继续在 /tmp 目录中写入 mapred 中间输出
【发布时间】:2014-04-01 10:43:14
【问题描述】:

我在 /tmp 中的容量有限,因此我想将 mapred 的所有中间输出移动到更大的分区中,例如 /home/hdfs/tmp_data。
如果我理解正确,我只需要设置

<property>
<name>mapred.child.tmp</name>
<value>/home/hdfs/tmp_data</value>

在 mapred-site.xml
我通过 Ambari 重新启动集群,我检查了所有内容都写入了 conf 文件中, 但是,当我运行一个猪脚本时,它一直在写:

/tmp/hadoop-hdfs/mapred/local/taskTracker/hdfs/jobcache/job_localXXX/attempt_YY/output 我还将 core-site.xml 中的 hadoop.tmp.dir 修改为 /home/hdfs/tmp_data ,但没有任何变化。
是否有任何参数会覆盖我的设置?

【问题讨论】:

    标签: hadoop configuration mapreduce


    【解决方案1】:

    尝试覆盖 tasktracker 节点 mapred-site.xml 文件中的以下属性并重新启动它。

    <property>
    <name>mapred.local.dir/name>
    <value>/home/hdfs/tmp_data</value>
    </property>
    

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2013-10-15
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2018-06-30
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多