【问题标题】:why isn't hadoop distributing a file to all nodes?为什么 hadoop 不向所有节点分发文件?
【发布时间】:2013-12-09 15:28:27
【问题描述】:

我根据http://www.michael-noll.com/tutorials/running-hadoop-on-ubuntu-linux-multi-node-cluster/ 中的演练设置了一个 4 节点 hadoop 集群。我使用了 1 的复制(集群仅用于测试)

我从本地复制了一个 2GB 的文件。在 http 界面中浏览文件时,我看到它被拆分为 31 个块,但它们都在一个节点(主节点)上

这是正确的吗?我该如何调查原因?

【问题讨论】:

    标签: hadoop hdfs


    【解决方案1】:

    它们都在一个节点上,因为默认情况下 Hadoop 会默认首先写入本地节点。我猜你正在使用那个节点的 Hadoop 客户端。因为你有一个副本,所以它只会在那个节点上。

    由于您只是在玩耍,您可能希望强制将数据分散出去。为此,您可以使用hadoop rebalancer 运行rebalancer。几分钟后只需 control-C 即可。

    【讨论】:

    • hadoop 平衡器给我'集群是平衡的。退出...'
    猜你喜欢
    • 2013-11-26
    • 1970-01-01
    • 2011-09-17
    • 2021-12-04
    • 2011-03-12
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-06-19
    相关资源
    最近更新 更多