【发布时间】:2012-05-31 16:33:36
【问题描述】:
我想编写一个脚本或类似 .xml 文件的文件,它明确定义 Hadoop 集群中的数据节点以存储特定的文件块。 例如: 假设有 4 个从节点和 1 个主节点(hadoop 集群共有 5 个节点)。 有两个文件 file01(size=120 MB) 和 file02(size=160 MB)。默认块大小 =64MB
现在我想在从节点 1 存储两个 file01 块中的一个,在从节点 2 存储另一个。 类似地,从节点 1 的三个文件块之一,从节点 3 的第二个文件块和从节点 4 的第三个文件块之一。 所以,我的问题是我该怎么做?
其实有一种方法:每次都修改conf/slaves文件来存储一个文件。 但我不想这样做 那么,还有另一种解决方案吗? 我希望我的观点很清楚。 等待您的友好回应..!!!
【问题讨论】:
-
请少说几句为什么需要它
-
@DavidGruzman 我想确定一个特定的数据节点肯定会在某个特定的地方存储一些文件块。我的意思是这可以帮助我使用 hadoop 和其他一些集群管理框架在集群内进行负载平衡..