【发布时间】:2017-03-24 08:40:35
【问题描述】:
我在 Hadoop 中有一个由两台机器组成的多节点集群。 第一台机器(配置的主从机)运行名称节点和数据节点,第二台机器(配置的从机)运行数据节点。
我想在它们之间几乎平等地上传和分配数据?
我有两种情况:
首先:假设我有一个大小为 500MB 的文件 file1,我使用以下方式上传到第一台机器:
hadoop fs -put file1 hdfspath
它会被分成两个数据节点还是只存储在第一台机器上?
什么时候分配:是在超过第一台机器的块大小之后才分配还是有另一个标准。
每个datanode会平分250mb吗?
第二:假设我有 250 个文件,每个文件大小为 2mb,我将包含它们的文件夹 dir1 上传到第一台机器,使用:
hadoop fs -put dir1 hdfspath
同样的问题:数据是分布在两台机器上还是只分布在第一台机器上。以及何时以及如何分配?
谢谢。
【问题讨论】:
标签: hadoop hdfs hadoop2 slave namenode